{"as_of":"2026-08-10T14:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d7571e45b1ce6e8776e072c7fc03117b8f6ad28deb1def9af074cfeae00d70c","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:45:17.660092Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.06113/citation-record","integrity":"/paper/2502.06113/integrity","json":"/paper/2502.06113/citation-record.json","paper":"/paper/2502.06113"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.410921Z","title":"It refers to the process of determining a path or set of movements, that ensures a robot or swarm thoroughly covers a given area or surface","venue":null,"work_id":"db23af24-b27b-4830-8255-ca29e03ef206","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.433678Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:e46908e40d50d3bed58540c909ba9d92871dcbddfa004f8a183700a8a009861b","observation_id":"abb96bfa-0dbe-4932-a438-bd80b8f69325","resolution":{"observed_at":"2026-08-08T16:45:18.416073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.396249Z","title":"This environment can be either known or unknown","venue":null,"work_id":"ea7b61a2-bd50-46b2-958d-613c182981dc","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.439182Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:1b3903ad94cfbe4e5139a3335eec22923ff150b0b97b401d53cd966b871f4b06","observation_id":"273f97ce-c745-4405-a28c-06df49f509e3","resolution":{"observed_at":"2026-08-08T16:45:18.401502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.366539Z","title":"Then, the epsilon-greedy method is chosen to improve exploration during training and facilitate the incorporation of the PSO with the first version of the MASAC","venue":null,"work_id":"e11f8d22-0004-4f3b-abe2-1506c07b52a4","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.449539Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:74487b3a1546b70270a8dc1ff5144031bfb6173f88c4e30323093ff6d76070b2","observation_id":"c7647a79-500a-433c-b29e-5cc1a80a49f8","resolution":{"observed_at":"2026-08-08T16:45:18.371369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.351129Z","title":"One of the chosen metrics for the evaluation is the reward value","venue":null,"work_id":"46200767-5f22-4e9a-9d4c-6b46b1f126b5","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.454964Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:a5ddf51f61d4b597934690ec4339bb74c8fb31fc3e048fbe91317a86afefa856","observation_id":"a4f81953-5d06-408d-a89c-8b12a926a371","resolution":{"observed_at":"2026-08-08T16:45:18.355986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.336852Z","title":null,"venue":null,"work_id":"b13a97b5-c494-4b46-827d-8f025237d31f","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.459856Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:ee51b68e091828650cfbe65b3d92652c90e72a35640bf2f420ada05d21be726a","observation_id":"87d4b32d-a796-47b5-a2a8-a8a1fa2f235a","resolution":{"observed_at":"2026-08-08T16:45:18.341516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.264470Z","title":"Deep reinforcement learning for multiagent systems: A review of challenges, solutions, and applications,","venue":null,"work_id":"5b96c065-d2c4-4882-bf79-9aa84eb4f8ad","year":2020},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.491223Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:ca492da66a246f8259c66b8cda6b1c948db08c3b4ecd5a667d7e7813f52460c1","observation_id":"1d33d3ac-930a-4e54-ba50-e66f028b7dee","resolution":{"observed_at":"2026-08-08T16:45:18.268937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11378","last_updated":"2024-01-21T03:01:00Z","snapshot_observed_at":"2026-08-09T23:23:46.626878Z","submitted_at":"2024-01-21T03:01:00Z","title":"Multi-Agent Generative Adversarial Interactive Self-Imitation Learning for AUV Formation Control and Obstacle Avoidance","version":1},"cited_work":{"arxiv_id":"2401.11378","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.11378","snapshot_observed_at":"2026-08-08T16:45:17.728137Z","title":"Multi-Agent Generative Adversarial Interactive Self-Imitation Learning for AUV Formation Control and Obstacle Avoidance","venue":"cs.RO","work_id":"a89e5c14-3122-45c0-a4c8-0039ad7e1cec","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.465692Z"},"links":{"cited_paper":"/paper/2401.11378","citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:1a71b22d3097cc9533e78226550903b03d057de4ba78d5997ecc4b17131f0058","observation_id":"1e84e4d5-fd69-4599-8d8e-463e6ec058bb","resolution":{"observed_at":"2026-08-08T16:45:17.735834Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.322422Z","title":"A multi -agent framework with moos-ivp for autonomous underwater vehicles with sidescan sonar sensors,","venue":null,"work_id":"9634dd40-1af2-4500-a7a8-1f6ff4848b54","year":2011},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.470720Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:51fbb11a868a2cd874e5125c007e86f00a9b80fb23fa80b472df7d302482e76a","observation_id":"982cb50b-fa8d-4473-b73c-e76256481ef9","resolution":{"observed_at":"2026-08-08T16:45:18.326993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.308379Z","title":"A survey on swarm robotics for area coverage problem,","venue":null,"work_id":"efe4acf2-b914-448b-9e92-2469a9e0ff1e","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.475913Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:6c7d8e292330bcfe3e24aa1f020ea644aaa857ad256aeb4cc9d3f22ba9d229fe","observation_id":"0bb748c7-f6a9-4782-a540-ba2971c3937c","resolution":{"observed_at":"2026-08-08T16:45:18.313006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.293863Z","title":null,"venue":null,"work_id":"749141e2-8587-4d66-8cbd-337784594587","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.481025Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:7356b89046acbe437dcaa0c18f1cc0cdcf19bdf8085e8826dc2bb80a402cebe5","observation_id":"9dad8229-07fe-4680-9283-a23270629952","resolution":{"observed_at":"2026-08-08T16:45:18.298630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.278931Z","title":"Buşoniu, R","venue":null,"work_id":"45a7681b-bb98-45c3-9227-dec790508960","year":2010},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.486029Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:687c84ae1946f738142d1ddc39fd4514f1d3e1f047cc634c95c02adf5fc1abf0","observation_id":"8e87ce62-82ee-49ea-980e-15cf8f5defdd","resolution":{"observed_at":"2026-08-08T16:45:18.283796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.189742Z","title":"Multi -agent reinforcement learning: A selective overview of theories and algorithms,","venue":null,"work_id":"5d0820ec-aedd-4b57-bb7f-68876b276820","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.521597Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:06c2bbf2eb9bd679a6f9705fe192f0a15e4bf607f754007b99265a9c17817b9c","observation_id":"4062682d-c4bf-42ec-8fb8-c89367072fff","resolution":{"observed_at":"2026-08-08T16:45:18.194350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.11881","last_updated":"2021-03-04T13:02:59Z","snapshot_observed_at":"2026-08-09T23:23:00.930039Z","submitted_at":"2020-03-24T11:05:41Z","title":"An empirical investigation of the challenges of real-world reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.11881","snapshot_observed_at":"2026-08-08T16:45:17.496518Z","title":"An empirical investigation of the challenges of real -world reinforcement learning,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.496518Z"},"links":{"cited_paper":"/paper/2003.11881","citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:51d90e9bc7d3d1d87b935d3d757f6c40d8dbd7357feb20abdc0ede30ee48da3d","observation_id":"3d6f99fc-0e4d-4d20-b4ea-ec7b5953206e","resolution":{"observed_at":"2026-08-08T16:45:17.496518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.249140Z","title":"Multi -robot path planning using an improved self -adaptive particle swarm optimization,","venue":null,"work_id":"34a67969-5beb-47fe-8bff-058f1cf5916f","year":2020},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.501870Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:4b7a776cd636170ff74c131787554b67b2e7300fadf5b20d4f80772ead7d9fa3","observation_id":"ecbd545d-e1ed-48d2-a25e-6b0b923ec27c","resolution":{"observed_at":"2026-08-08T16:45:18.254248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.233995Z","title":"Group decisions in humans and animals: A survey,","venue":null,"work_id":"1d76988d-b43e-43bb-819e-5aed82267abf","year":2008},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.506755Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:3e63906a9f5a44ab8fd8345b1051717a71b44c6a74b4cc5741c62b1239d729a3","observation_id":"61b184c1-99a3-4f71-84d3-1754267870f5","resolution":{"observed_at":"2026-08-08T16:45:18.238665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.219633Z","title":"From animal collective behaviors to swarm robotic cooperation,","venue":null,"work_id":"1acc630a-be6a-4733-a016-0800d67d2599","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.511594Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:a7179ca485daaac9d38963dd2e8622dbb9a9f535f8ebab9d9ef5622b9731425c","observation_id":"98b29bea-e15e-4585-8577-d1066e378b5c","resolution":{"observed_at":"2026-08-08T16:45:18.224268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.204598Z","title":"Sample efficient multi-agent reinforcement learning with masked reconstruction,","venue":null,"work_id":"e5f3f88e-8522-4a63-8f3f-46631533c8a7","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.516727Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:5a122d4e77940dd6630b58f9188df62f4837747e6b3d71e531ce515e67fa0971","observation_id":"71208a3d-ccbb-4bd7-b78d-b71a8e206246","resolution":{"observed_at":"2026-08-08T16:45:18.209389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.101764Z","title":"Multi-agent reinforcement learning: a critical survey,","venue":null,"work_id":"ea0d2dfa-83fc-496f-a614-5974c489f6b2","year":2003},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.550000Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:a81299e265383caf75ad4354e877ba522e7e3bba9e71b126672e553b1bf0ff23","observation_id":"cf726d11-10d0-4005-ae16-30e368c59876","resolution":{"observed_at":"2026-08-08T16:45:18.106374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.174514Z","title":"A survey and critique of multiagent deep reinforcement learning,","venue":null,"work_id":"85d1bc51-1898-488c-a2a9-24e4926081ff","year":2019},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.526242Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:8bd7503b745c8d77308eba3846d3fa8366cdb1da6d4c1db0fa819e370fe8598b","observation_id":"eb51cdbb-c60f-455f-a049-bb008d303251","resolution":{"observed_at":"2026-08-08T16:45:18.179774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.381602Z","title":"Value-based methods [22] estimate the value of each state or state -action pair to derive optimal policies by selecting actions that maximize the cumulative reward","venue":null,"work_id":"ec95566d-d98f-4517-ac2c-651120ede0bc","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.444002Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:23959906745f659b1a9858ecd1bf16de0830e0e93544470c9b74638ca2732857","observation_id":"9bbe0531-54d1-4944-8e41-f8cce4951621","resolution":{"observed_at":"2026-08-08T16:45:18.386370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.159904Z","title":"Multi-agent reinforcement learning: A review of challenges and applications,","venue":null,"work_id":"aff56420-b7aa-4374-aabd-18cffb953213","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.530828Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:8d5e9707a83b29f24185aa1a38d234d45550f3338eaaaac04f62381528c46d97","observation_id":"4411e184-94d5-43f6-9fe7-321bfd02ef13","resolution":{"observed_at":"2026-08-08T16:45:18.164646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.145727Z","title":"Decentralised learning in systems with many, many strategic agents,","venue":null,"work_id":"9108ce70-6e00-4eac-81b5-0aabffe21087","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.535528Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:1b6279359b4d428a051139d740cad4b992f377d107564c93eb7694ef3bcf21c2","observation_id":"50b40735-6b42-4ec3-aadd-327bcc2eab2f","resolution":{"observed_at":"2026-08-08T16:45:18.150351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.131150Z","title":"An efficient centralized multi-agent reinforcement learner for cooperative tasks,","venue":null,"work_id":"093d78d7-6c07-4af1-8b36-74f3b9b22f0e","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.540381Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:2e158ea80b7b7e66dc86c66e2aeb7cda9aaec36352c8477f94b81fc48e896b39","observation_id":"9cae0347-92ca-4334-8e15-edb8f0d13012","resolution":{"observed_at":"2026-08-08T16:45:18.136007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.116493Z","title":"Fully decentralized cooperative multi-agent reinforcement learning: A survey,","venue":null,"work_id":"a049795e-deda-4cf3-b1ab-775fe34c5139","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.545146Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:173d14dfe08513f4ccca18cb3c790f849585ebf1b708f83f5169aec171daa630","observation_id":"7952996a-9bae-4e78-a30c-5605b8f36e03","resolution":{"observed_at":"2026-08-08T16:45:18.121258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.087499Z","title":"Entropy regularized actor-critic based multi-agent deep reinforcement learning for stochastic games,","venue":null,"work_id":"fd063ded-b31b-4abf-ae82-1154d259b6cc","year":2022},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.554790Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:1bb9ae83e047f57a67096ee5fb890819d732dbc9a19134fac708a7908a9b0969","observation_id":"d7568734-782b-465a-a9d2-7e59c2024b0f","resolution":{"observed_at":"2026-08-08T16:45:18.092185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-08T16:45:17.559339Z","title":"Soft actor-critic algorithms and applications,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.559339Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:cb39be54c14ed2199a17a967d37370d8c526fc37f5b92195f65e456c1571d9b3","observation_id":"a5ebed8b-25bf-4813-9c02-f66a98935604","resolution":{"observed_at":"2026-08-08T16:45:17.559339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.072030Z","title":"Evaluation of a deep reinforcement-learning-based controller for the control of an autonomous underwater vehicle,","venue":null,"work_id":"bbae6806-56be-48db-92e3-ed3157eb50e3","year":2020},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.564292Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:1691c239cc641c3ce25772900ca5dc23144827b384c84e4e59b35433e02e6bd4","observation_id":"219ad0d0-9e7b-49e4-ab94-d283b730e6cb","resolution":{"observed_at":"2026-08-08T16:45:18.077725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.056884Z","title":"Leveraging world model disentanglement in value-based multi- agent reinforcement learning,","venue":null,"work_id":"5c27894e-97ec-4ecd-a9cb-1530663d434c","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.569154Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:0ec1f0536afa9b4048a9f93d88f4ac4e672b2ed3674dc787393ac62f0381112b","observation_id":"ad5cc09f-6f48-4f54-9f36-aacab44778e0","resolution":{"observed_at":"2026-08-08T16:45:18.062131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.041603Z","title":"A collaborative multiagent reinforcement learning method based on policy gradient potential,","venue":null,"work_id":"63ccbc13-54fc-43d7-9d74-e60842d46f93","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.573472Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:bc259e18ea6515c51c33c77b7a381523e6436f62da222d583c8ebc310be75afc","observation_id":"b51f8442-ad12-438a-803a-580a3eb11b70","resolution":{"observed_at":"2026-08-08T16:45:18.046399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.026662Z","title":"Learning to walk via deep reinforcement learning,","venue":null,"work_id":"8aca7b36-eac1-4223-941c-620e4ba8e5b5","year":2019},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.577934Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:46a543144481c5c0d32632695d48416ab12af782add05dbcd1e9e34036cf61eb","observation_id":"c304391f-5f75-4daa-abf3-f7246bd797c8","resolution":{"observed_at":"2026-08-08T16:45:18.031577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.011654Z","title":"Sampling efficient deep reinforcement learning through preference-guided stochastic exploration,","venue":null,"work_id":"0256d1fd-02cf-4375-a602-1a746766985a","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.582158Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:963afb8d910a30239aa37d7c36d8f2d160460516fdbe8f5d77ff2158650ad38b","observation_id":"a5156528-d142-4a9f-8676-e616a80d7efb","resolution":{"observed_at":"2026-08-08T16:45:18.016412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.996784Z","title":"Heuristic-guided reinforcement learning,","venue":null,"work_id":"56ada605-5a0f-4ec8-998b-b755d09c2bd3","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.586664Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:562569c15c857812e94fbda3272c78f12dbfffc33b69964978d7be0586d86e1f","observation_id":"44ed5261-e358-4d88-b6cd-996022d156ab","resolution":{"observed_at":"2026-08-08T16:45:18.001581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.981454Z","title":"Heuristically accelerated reinforcement learning: Theoretical and experimental results,","venue":null,"work_id":"4dac5556-dacb-4804-953e-e9f44bce10a6","year":2012},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.591170Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:77a33d0aa4fbc08b3db5b0fbf10efd3ff002ce3c494a3f1c1bada234effb589f","observation_id":"a6c92d13-05da-48d7-8356-3eba463f5a95","resolution":{"observed_at":"2026-08-08T16:45:17.986376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.966804Z","title":"Transferring knowledge as heuristics in reinforcement learning: A case-based approach,","venue":null,"work_id":"f4b25bdf-186d-428d-a467-db7feb5bad93","year":2015},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.595424Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:800af1df91deba5451ff10cfeea848527e56268f5107420085f037d17da3b7d7","observation_id":"0e201400-f711-4f32-8838-fde2336bf79c","resolution":{"observed_at":"2026-08-08T16:45:17.971416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.952194Z","title":"Heuristically Accelerated Reinforcement Learning by Means of Case-Based Reasoning and Transfer Learning,","venue":null,"work_id":"791dcd76-a734-4193-afc4-d82e587fc449","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.599928Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:bcfd362fa301c9020169af90f094e3470e07fb04fcda253718b01b3e5e3197c1","observation_id":"64b3559c-c0cd-4759-9a9c-b0d4d9550d3c","resolution":{"observed_at":"2026-08-08T16:45:17.957079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.936927Z","title":"Ant system: optimization by a colony of cooperating agents,","venue":null,"work_id":"c56fe00e-c80e-46d7-b59c-3b1f2440e5a2","year":1996},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.604590Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:e20d367b511e2052a7493f6f3cf0a23dc0a7a51af1faefcfcdf133989ed2704f","observation_id":"9b219dd5-5c92-402c-8db3-c7f6dac807c5","resolution":{"observed_at":"2026-08-08T16:45:17.941959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.921256Z","title":"The bees algorithm and mechanical design optimisation,","venue":null,"work_id":"60387413-0d0a-40ed-86b5-3d45dd018a98","year":2008},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.609190Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:883e145ab07341f4ee5cf459c161fa8cce200c19e48c737315783030ce113a22","observation_id":"747fc2de-80cf-4c29-b5cc-7fcc64b9b29b","resolution":{"observed_at":"2026-08-08T16:45:17.926120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.905747Z","title":"Firefly algorithms for multimodal optimization,","venue":null,"work_id":"b8df574e-38da-437e-ba67-41127ed50b03","year":2009},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.613713Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:5785df02ab5150d617a707acc4309ba4a78e9f79290c2ad7b77d59f83faeb30e","observation_id":"d00e7d7d-dd25-4594-a6a1-f147871ebddb","resolution":{"observed_at":"2026-08-08T16:45:17.910718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.889709Z","title":"Brain storm optimization algorithm,","venue":null,"work_id":"662d3f21-126c-44d5-a6b5-57a9f29bfe5b","year":2011},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.618424Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:8156bcba3da6793463b880fc51e1e6e544c251d071cc6162a041c88532cc4cec","observation_id":"b3145215-8b85-4ce8-9a54-9a5c89c7ca37","resolution":{"observed_at":"2026-08-08T16:45:17.894455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.875077Z","title":"Group search optimizer: An optimization algorithm inspired by animal searching behavior,","venue":null,"work_id":"3122e93e-4aed-4f0e-9198-3531aae669a3","year":2009},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.623267Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:9220709799045fc03e1bacb049c36650cc303964f6b66ed0d34473a2f8471d0c","observation_id":"17e15b61-98b5-490c-87ac-3e8251b864e3","resolution":{"observed_at":"2026-08-08T16:45:17.879904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.859898Z","title":"Solving engineering design problems by social cognitive optimization,","venue":null,"work_id":"f15f82f3-0faa-4239-b302-7c6b0a7f4460","year":2004},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.627931Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:f2df7f61de05b90cccc554fd58d482acbdea28132341954aa960ad997a62c861","observation_id":"1c4c3b39-6653-428d-9ba4-457f1302fefd","resolution":{"observed_at":"2026-08-08T16:45:17.864951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.844575Z","title":"Particle swarm optimization,","venue":null,"work_id":"b974f86f-19f9-4d6a-ad21-850387deda74","year":1995},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.632726Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:d5e3f652f2676042930c3c33c5a539cb210e9ba521be897227f428b01b059dd0","observation_id":"907fce4d-ec6b-4bee-bbc6-ad0d109cd0ef","resolution":{"observed_at":"2026-08-08T16:45:17.849273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.828610Z","title":"Distributed 3-d path planning for multi-uavs with full area surveillance based on particle swarm optimization,","venue":null,"work_id":"a071169a-8f21-404e-a839-73d2d8a598a2","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.637226Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:a1cbb588c691d5532ef429043acc5b657df362fcc02c87325538d894a982cacd","observation_id":"35ff0bfd-42e2-49bb-b08f-4ce87f845130","resolution":{"observed_at":"2026-08-08T16:45:17.834147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.812337Z","title":"Particle swarm optimization algorithm and its applications: A systematic review,","venue":null,"work_id":"acc3e972-5d81-4755-b502-dbd785fb64bb","year":2022},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.641924Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:37cbc8251c0f4b8562bdb4a7f650972928a1a5c243cc486b42e243ad802c82a8","observation_id":"1068253a-6dc0-4ff8-87e7-86fe797f71a9","resolution":{"observed_at":"2026-08-08T16:45:17.817444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.795999Z","title":"Sim-to-real transfer of adaptive control parameters for auv stabilisation under current disturbance,","venue":null,"work_id":"eaf79821-d645-44f9-becb-4c37a362e316","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.646377Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:05b4eefb18a2ee09178b27fe2c2df0d3f27aa6c6d849691693e416b62757e56a","observation_id":"42c7d4af-ad0b-4a18-a990-5014cbe49ef1","resolution":{"observed_at":"2026-08-08T16:45:17.800829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.780598Z","title":"A deeper look at experience replay,","venue":null,"work_id":"d161fe5d-dee5-45ad-a07b-a18b34e1fd2d","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.651026Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:eb7f8c967e47e5f7d9df78bd240093d13f848b60c67101c37cd1a7b72e5de64d","observation_id":"7c446ed9-fa46-435f-af65-88d8a34ebd33","resolution":{"observed_at":"2026-08-08T16:45:17.785395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.763389Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":"29f446e0-fe4b-4f78-b22a-74941cccbd1b","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.655612Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:658f767fe2a67053266239f09daae813514ba737f9b101e403d36074ea4abab4","observation_id":"e5923bd0-637d-4b4d-b9a4-2a304d0d1442","resolution":{"observed_at":"2026-08-08T16:45:17.768383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.746712Z","title":"Learning adaptive control of a uuv using a bio-inspired experience replay mechanism,","venue":null,"work_id":"f5d79e0d-94fd-41c6-a171-83349a2e5a10","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.660092Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:85830eea055ae8c1a5a1f2da97014d68fee2209c7423c736e739d7441d2001d1","observation_id":"842c66fc-812d-4e2c-9a54-2e812af0fe69","resolution":{"observed_at":"2026-08-08T16:45:17.751603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-10T11:55:32.984327Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":43},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2502.06113."}