{"as_of":"2026-08-10T00:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7f885ba136019471f0872cf189212b836f6b4943685d466d7b09733d3a3382b","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:45:17.660092Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.06113/citation-record","integrity":"/paper/2502.06113/integrity","json":"/paper/2502.06113/citation-record.json","paper":"/paper/2502.06113"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.410921Z","title":"It refers to the process of determining a path or set of movements, that ensures a robot or swarm thoroughly covers a given area or surface","venue":null,"work_id":"db23af24-b27b-4830-8255-ca29e03ef206","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.433678Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:0d95694a005bc5199129259813fc55acdd71295158d4088fd2df962b258dff80","observation_id":"abb96bfa-0dbe-4932-a438-bd80b8f69325","resolution":{"observed_at":"2026-08-08T16:45:18.416073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.396249Z","title":"This environment can be either known or unknown","venue":null,"work_id":"ea7b61a2-bd50-46b2-958d-613c182981dc","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.439182Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:770c2af05330d42bb65e344da2d28ca60e1328899f9735d6d4e92229ce47ebf5","observation_id":"273f97ce-c745-4405-a28c-06df49f509e3","resolution":{"observed_at":"2026-08-08T16:45:18.401502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.366539Z","title":"Then, the epsilon-greedy method is chosen to improve exploration during training and facilitate the incorporation of the PSO with the first version of the MASAC","venue":null,"work_id":"e11f8d22-0004-4f3b-abe2-1506c07b52a4","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.449539Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:6390855ab3111e561897591fe3960d6cd748f5888533fe27069f856e3e8c0330","observation_id":"c7647a79-500a-433c-b29e-5cc1a80a49f8","resolution":{"observed_at":"2026-08-08T16:45:18.371369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.351129Z","title":"One of the chosen metrics for the evaluation is the reward value","venue":null,"work_id":"46200767-5f22-4e9a-9d4c-6b46b1f126b5","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.454964Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:d3acd064cd1cf2575895e9e1fcd3a9eb7ad0dc0e1b8b79c9ac82c43933778958","observation_id":"a4f81953-5d06-408d-a89c-8b12a926a371","resolution":{"observed_at":"2026-08-08T16:45:18.355986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.336852Z","title":null,"venue":null,"work_id":"b13a97b5-c494-4b46-827d-8f025237d31f","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.459856Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:4cd9b599f5e6d83922aba763239ea589ea87cdd6203a657ea1c098894da26dc7","observation_id":"87d4b32d-a796-47b5-a2a8-a8a1fa2f235a","resolution":{"observed_at":"2026-08-08T16:45:18.341516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.264470Z","title":"Deep reinforcement learning for multiagent systems: A review of challenges, solutions, and applications,","venue":null,"work_id":"5b96c065-d2c4-4882-bf79-9aa84eb4f8ad","year":2020},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.491223Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:9b339f5eea3a9c197505ec4fcfef7a6b2d5cb8dd89031dfcfcc5ba7f19abb408","observation_id":"1d33d3ac-930a-4e54-ba50-e66f028b7dee","resolution":{"observed_at":"2026-08-08T16:45:18.268937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11378","last_updated":"2024-01-21T03:01:00Z","snapshot_observed_at":"2026-08-09T23:23:46.626878Z","submitted_at":"2024-01-21T03:01:00Z","title":"Multi-Agent Generative Adversarial Interactive Self-Imitation Learning for AUV Formation Control and Obstacle Avoidance","version":1},"cited_work":{"arxiv_id":"2401.11378","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.11378","snapshot_observed_at":"2026-08-08T16:45:17.728137Z","title":"Multi-Agent Generative Adversarial Interactive Self-Imitation Learning for AUV Formation Control and Obstacle Avoidance","venue":"cs.RO","work_id":"a89e5c14-3122-45c0-a4c8-0039ad7e1cec","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.465692Z"},"links":{"cited_paper":"/paper/2401.11378","citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:a654f46c76872bb82622a35ac2d4049b796d6d5448067acea88838af01124b6e","observation_id":"1e84e4d5-fd69-4599-8d8e-463e6ec058bb","resolution":{"observed_at":"2026-08-08T16:45:17.735834Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.322422Z","title":"A multi -agent framework with moos-ivp for autonomous underwater vehicles with sidescan sonar sensors,","venue":null,"work_id":"9634dd40-1af2-4500-a7a8-1f6ff4848b54","year":2011},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.470720Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:e76804be52ca153944b3689996f398298dd465ead7879b915781bcc9931a8555","observation_id":"982cb50b-fa8d-4473-b73c-e76256481ef9","resolution":{"observed_at":"2026-08-08T16:45:18.326993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.308379Z","title":"A survey on swarm robotics for area coverage problem,","venue":null,"work_id":"efe4acf2-b914-448b-9e92-2469a9e0ff1e","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.475913Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:c5314c6c2e965ed314c9eb825dd77b76c2e91ae4ea7fca5b6cc67ffaea0ae24a","observation_id":"0bb748c7-f6a9-4782-a540-ba2971c3937c","resolution":{"observed_at":"2026-08-08T16:45:18.313006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.293863Z","title":null,"venue":null,"work_id":"749141e2-8587-4d66-8cbd-337784594587","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.481025Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:820394e100a16d91d5d038316cef8099381f0a604d07f5fe48d71efd20fc044c","observation_id":"9dad8229-07fe-4680-9283-a23270629952","resolution":{"observed_at":"2026-08-08T16:45:18.298630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.278931Z","title":"Buşoniu, R","venue":null,"work_id":"45a7681b-bb98-45c3-9227-dec790508960","year":2010},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.486029Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:3c2b332ab29b994b328a1df578080022b88b6a1881398b6b5eaf5c002ad9c630","observation_id":"8e87ce62-82ee-49ea-980e-15cf8f5defdd","resolution":{"observed_at":"2026-08-08T16:45:18.283796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.189742Z","title":"Multi -agent reinforcement learning: A selective overview of theories and algorithms,","venue":null,"work_id":"5d0820ec-aedd-4b57-bb7f-68876b276820","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.521597Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:3db1a71da4e83ad0f52b27160e9602140fc511b6fbb2f803641717c6b1636699","observation_id":"4062682d-c4bf-42ec-8fb8-c89367072fff","resolution":{"observed_at":"2026-08-08T16:45:18.194350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.11881","last_updated":"2021-03-04T13:02:59Z","snapshot_observed_at":"2026-08-09T23:23:00.930039Z","submitted_at":"2020-03-24T11:05:41Z","title":"An empirical investigation of the challenges of real-world reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.11881","snapshot_observed_at":"2026-08-08T16:45:17.496518Z","title":"An empirical investigation of the challenges of real -world reinforcement learning,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.496518Z"},"links":{"cited_paper":"/paper/2003.11881","citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:88ff2840b9f96794ed3cbcda96e6ead08e434b1613d4964aa6ee192e29d404bb","observation_id":"3d6f99fc-0e4d-4d20-b4ea-ec7b5953206e","resolution":{"observed_at":"2026-08-08T16:45:17.496518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.249140Z","title":"Multi -robot path planning using an improved self -adaptive particle swarm optimization,","venue":null,"work_id":"34a67969-5beb-47fe-8bff-058f1cf5916f","year":2020},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.501870Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:b3ebe8d111d3355082f1972c31108a408a00019344ab394e04af78d4754f902c","observation_id":"ecbd545d-e1ed-48d2-a25e-6b0b923ec27c","resolution":{"observed_at":"2026-08-08T16:45:18.254248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.233995Z","title":"Group decisions in humans and animals: A survey,","venue":null,"work_id":"1d76988d-b43e-43bb-819e-5aed82267abf","year":2008},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.506755Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:c6dc94f8ae50591ac3d176af5b60a5fe3149eb972a852570f2d71133ba30dd46","observation_id":"61b184c1-99a3-4f71-84d3-1754267870f5","resolution":{"observed_at":"2026-08-08T16:45:18.238665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.219633Z","title":"From animal collective behaviors to swarm robotic cooperation,","venue":null,"work_id":"1acc630a-be6a-4733-a016-0800d67d2599","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.511594Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:d6eb5cf7dec60f82408280e961ef5b80f5d241120e1bf2a49f80eb0522dec647","observation_id":"98b29bea-e15e-4585-8577-d1066e378b5c","resolution":{"observed_at":"2026-08-08T16:45:18.224268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.204598Z","title":"Sample efficient multi-agent reinforcement learning with masked reconstruction,","venue":null,"work_id":"e5f3f88e-8522-4a63-8f3f-46631533c8a7","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.516727Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:a24cd5d68bed3174c2b1bb17c91fcbe404d949b359ff6ff5192b3ebb3889631f","observation_id":"71208a3d-ccbb-4bd7-b78d-b71a8e206246","resolution":{"observed_at":"2026-08-08T16:45:18.209389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.101764Z","title":"Multi-agent reinforcement learning: a critical survey,","venue":null,"work_id":"ea0d2dfa-83fc-496f-a614-5974c489f6b2","year":2003},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.550000Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:6013b9c28fb47e02bef105f723e6b977d192ca78e7c48c207739a8a5e723f284","observation_id":"cf726d11-10d0-4005-ae16-30e368c59876","resolution":{"observed_at":"2026-08-08T16:45:18.106374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.174514Z","title":"A survey and critique of multiagent deep reinforcement learning,","venue":null,"work_id":"85d1bc51-1898-488c-a2a9-24e4926081ff","year":2019},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.526242Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:2a1a31f076a09e50e5c8a2adc67bb8124a2b486ac095238ef15492d4974aabb0","observation_id":"eb51cdbb-c60f-455f-a049-bb008d303251","resolution":{"observed_at":"2026-08-08T16:45:18.179774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.381602Z","title":"Value-based methods [22] estimate the value of each state or state -action pair to derive optimal policies by selecting actions that maximize the cumulative reward","venue":null,"work_id":"ec95566d-d98f-4517-ac2c-651120ede0bc","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.444002Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:1b7bb4f86dbb0b4f25269abac549f748ca3878e2313803fee4ec1ab5190db947","observation_id":"9bbe0531-54d1-4944-8e41-f8cce4951621","resolution":{"observed_at":"2026-08-08T16:45:18.386370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.159904Z","title":"Multi-agent reinforcement learning: A review of challenges and applications,","venue":null,"work_id":"aff56420-b7aa-4374-aabd-18cffb953213","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.530828Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:6cc52dc25e0f54d2c39ffd7eeca51c86b279616a064842efe82fce1845d19cd9","observation_id":"4411e184-94d5-43f6-9fe7-321bfd02ef13","resolution":{"observed_at":"2026-08-08T16:45:18.164646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.145727Z","title":"Decentralised learning in systems with many, many strategic agents,","venue":null,"work_id":"9108ce70-6e00-4eac-81b5-0aabffe21087","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.535528Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:8571dc12f82780f20ffe6fb40a4a7cd3dc3fc45ef2d20181dfc324e4e0f5a688","observation_id":"50b40735-6b42-4ec3-aadd-327bcc2eab2f","resolution":{"observed_at":"2026-08-08T16:45:18.150351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.131150Z","title":"An efficient centralized multi-agent reinforcement learner for cooperative tasks,","venue":null,"work_id":"093d78d7-6c07-4af1-8b36-74f3b9b22f0e","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.540381Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:e9a7bcf027b7028065ffcedd5649da88c0ab24f2e60a85374517e35241d070f4","observation_id":"9cae0347-92ca-4334-8e15-edb8f0d13012","resolution":{"observed_at":"2026-08-08T16:45:18.136007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.116493Z","title":"Fully decentralized cooperative multi-agent reinforcement learning: A survey,","venue":null,"work_id":"a049795e-deda-4cf3-b1ab-775fe34c5139","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.545146Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:cee4e01fae108f962aa09200a20f17b80b6f3c7c29cfa333c715f12be234dd2d","observation_id":"7952996a-9bae-4e78-a30c-5605b8f36e03","resolution":{"observed_at":"2026-08-08T16:45:18.121258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.087499Z","title":"Entropy regularized actor-critic based multi-agent deep reinforcement learning for stochastic games,","venue":null,"work_id":"fd063ded-b31b-4abf-ae82-1154d259b6cc","year":2022},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.554790Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:21b83f74d9d11175f464e4bc5efc83c546016afd82dadc4aef07b1065c8a3902","observation_id":"d7568734-782b-465a-a9d2-7e59c2024b0f","resolution":{"observed_at":"2026-08-08T16:45:18.092185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-08T16:45:17.559339Z","title":"Soft actor-critic algorithms and applications,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.559339Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:c2cd2c947f756372784d2be4754e82adb4dd6274cf3c599d87f23bdb53cea31a","observation_id":"a5ebed8b-25bf-4813-9c02-f66a98935604","resolution":{"observed_at":"2026-08-08T16:45:17.559339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.072030Z","title":"Evaluation of a deep reinforcement-learning-based controller for the control of an autonomous underwater vehicle,","venue":null,"work_id":"bbae6806-56be-48db-92e3-ed3157eb50e3","year":2020},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.564292Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:acdedd0df4dc99a795c4b1c1b65b0660eaefe50a17c98514787e326a1e2444a0","observation_id":"219ad0d0-9e7b-49e4-ab94-d283b730e6cb","resolution":{"observed_at":"2026-08-08T16:45:18.077725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.056884Z","title":"Leveraging world model disentanglement in value-based multi- agent reinforcement learning,","venue":null,"work_id":"5c27894e-97ec-4ecd-a9cb-1530663d434c","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.569154Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:e12e76c171a88c8eb4b3546c40e460e18652a508c02d8e1af0f9482d1d8f6c61","observation_id":"ad5cc09f-6f48-4f54-9f36-aacab44778e0","resolution":{"observed_at":"2026-08-08T16:45:18.062131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.041603Z","title":"A collaborative multiagent reinforcement learning method based on policy gradient potential,","venue":null,"work_id":"63ccbc13-54fc-43d7-9d74-e60842d46f93","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.573472Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:5bafea0fc8d86c1eee0daa15a7078b075983d03500fcca6a60a5678881ea05b2","observation_id":"b51f8442-ad12-438a-803a-580a3eb11b70","resolution":{"observed_at":"2026-08-08T16:45:18.046399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.026662Z","title":"Learning to walk via deep reinforcement learning,","venue":null,"work_id":"8aca7b36-eac1-4223-941c-620e4ba8e5b5","year":2019},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.577934Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:f7d07b762e417d462174bbacae155ef718edba6927e78a999719674589aa1ebd","observation_id":"c304391f-5f75-4daa-abf3-f7246bd797c8","resolution":{"observed_at":"2026-08-08T16:45:18.031577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:18.011654Z","title":"Sampling efficient deep reinforcement learning through preference-guided stochastic exploration,","venue":null,"work_id":"0256d1fd-02cf-4375-a602-1a746766985a","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.582158Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:860a26c8ecf1ef413f4e06721cef9167605854c99b1fb7b3894acfae22836c70","observation_id":"a5156528-d142-4a9f-8676-e616a80d7efb","resolution":{"observed_at":"2026-08-08T16:45:18.016412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.996784Z","title":"Heuristic-guided reinforcement learning,","venue":null,"work_id":"56ada605-5a0f-4ec8-998b-b755d09c2bd3","year":2024},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.586664Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:8a8bfdf26991eb2195e145c595a81ad00a64258dc5a8d59052321529cf345733","observation_id":"44ed5261-e358-4d88-b6cd-996022d156ab","resolution":{"observed_at":"2026-08-08T16:45:18.001581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.981454Z","title":"Heuristically accelerated reinforcement learning: Theoretical and experimental results,","venue":null,"work_id":"4dac5556-dacb-4804-953e-e9f44bce10a6","year":2012},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.591170Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:7f0f4d16d9a7db0193fd72fc12ed5a6f03800eb4971af628b52e71ca84054192","observation_id":"a6c92d13-05da-48d7-8356-3eba463f5a95","resolution":{"observed_at":"2026-08-08T16:45:17.986376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.966804Z","title":"Transferring knowledge as heuristics in reinforcement learning: A case-based approach,","venue":null,"work_id":"f4b25bdf-186d-428d-a467-db7feb5bad93","year":2015},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.595424Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:2011f246184bab5cc9406f71fc2129e7b2fa087311629826b49f34f535a8f1c4","observation_id":"0e201400-f711-4f32-8838-fde2336bf79c","resolution":{"observed_at":"2026-08-08T16:45:17.971416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.952194Z","title":"Heuristically Accelerated Reinforcement Learning by Means of Case-Based Reasoning and Transfer Learning,","venue":null,"work_id":"791dcd76-a734-4193-afc4-d82e587fc449","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.599928Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:1f01168fdae7e55588f02e957eb6e721d957f6de559d4d62ece44ba222a28412","observation_id":"64b3559c-c0cd-4759-9a9c-b0d4d9550d3c","resolution":{"observed_at":"2026-08-08T16:45:17.957079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.936927Z","title":"Ant system: optimization by a colony of cooperating agents,","venue":null,"work_id":"c56fe00e-c80e-46d7-b59c-3b1f2440e5a2","year":1996},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.604590Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:da49b4a9b06247fc8a40b9903191cd390143096ba29851ba2e9195c088ac7612","observation_id":"9b219dd5-5c92-402c-8db3-c7f6dac807c5","resolution":{"observed_at":"2026-08-08T16:45:17.941959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.921256Z","title":"The bees algorithm and mechanical design optimisation,","venue":null,"work_id":"60387413-0d0a-40ed-86b5-3d45dd018a98","year":2008},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.609190Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:45d7b1c2663156dfeb4fde63f47415145a63e56b7010978ffcce310e3addc28b","observation_id":"747fc2de-80cf-4c29-b5cc-7fcc64b9b29b","resolution":{"observed_at":"2026-08-08T16:45:17.926120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.905747Z","title":"Firefly algorithms for multimodal optimization,","venue":null,"work_id":"b8df574e-38da-437e-ba67-41127ed50b03","year":2009},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.613713Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:92a2e30abfde28185d054a15680fa4bdd2822aa3c5de49817e743f44bcf59da9","observation_id":"d00e7d7d-dd25-4594-a6a1-f147871ebddb","resolution":{"observed_at":"2026-08-08T16:45:17.910718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.889709Z","title":"Brain storm optimization algorithm,","venue":null,"work_id":"662d3f21-126c-44d5-a6b5-57a9f29bfe5b","year":2011},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.618424Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:b159f4ac6113a60c1eabbc778181793d7d09661f6a9fe8cce5b4a13a05dd1a51","observation_id":"b3145215-8b85-4ce8-9a54-9a5c89c7ca37","resolution":{"observed_at":"2026-08-08T16:45:17.894455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.875077Z","title":"Group search optimizer: An optimization algorithm inspired by animal searching behavior,","venue":null,"work_id":"3122e93e-4aed-4f0e-9198-3531aae669a3","year":2009},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.623267Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:28d1889d508d4a3961d96b0ef2222fa5cc88dd97a4f928fde2deef2099ad4661","observation_id":"17e15b61-98b5-490c-87ac-3e8251b864e3","resolution":{"observed_at":"2026-08-08T16:45:17.879904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.859898Z","title":"Solving engineering design problems by social cognitive optimization,","venue":null,"work_id":"f15f82f3-0faa-4239-b302-7c6b0a7f4460","year":2004},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.627931Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:ec076ec9708262558fcb2210069d667f65ac66f87fcb3709899b6e99c18cdf20","observation_id":"1c4c3b39-6653-428d-9ba4-457f1302fefd","resolution":{"observed_at":"2026-08-08T16:45:17.864951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.844575Z","title":"Particle swarm optimization,","venue":null,"work_id":"b974f86f-19f9-4d6a-ad21-850387deda74","year":1995},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.632726Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:475554d04d637426a7efcdc9bb1968e02b77f118ce6bfe18f736955a61eb775c","observation_id":"907fce4d-ec6b-4bee-bbc6-ad0d109cd0ef","resolution":{"observed_at":"2026-08-08T16:45:17.849273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.828610Z","title":"Distributed 3-d path planning for multi-uavs with full area surveillance based on particle swarm optimization,","venue":null,"work_id":"a071169a-8f21-404e-a839-73d2d8a598a2","year":2021},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.637226Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:dfe1d4432b50603a9779b92f35926d70cd14ac99cf18de9f5f3c3613360daf63","observation_id":"35ff0bfd-42e2-49bb-b08f-4ce87f845130","resolution":{"observed_at":"2026-08-08T16:45:17.834147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.812337Z","title":"Particle swarm optimization algorithm and its applications: A systematic review,","venue":null,"work_id":"acc3e972-5d81-4755-b502-dbd785fb64bb","year":2022},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.641924Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:8c0267c1bc94a3a227f8a1e5e256980d1ceaf27e9ec92d53a57111827d80bb11","observation_id":"1068253a-6dc0-4ff8-87e7-86fe797f71a9","resolution":{"observed_at":"2026-08-08T16:45:17.817444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.795999Z","title":"Sim-to-real transfer of adaptive control parameters for auv stabilisation under current disturbance,","venue":null,"work_id":"eaf79821-d645-44f9-becb-4c37a362e316","year":null},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.646377Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:ec1f642ee99421e579ea572f49b0e3f58d7eb2f183dc10a6a0d60a24290583ee","observation_id":"42c7d4af-ad0b-4a18-a990-5014cbe49ef1","resolution":{"observed_at":"2026-08-08T16:45:17.800829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.780598Z","title":"A deeper look at experience replay,","venue":null,"work_id":"d161fe5d-dee5-45ad-a07b-a18b34e1fd2d","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.651026Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:d430680a27d57de3f323494b54e96614d086bfd1b4c2042675e80fd2f9d77466","observation_id":"7c446ed9-fa46-435f-af65-88d8a34ebd33","resolution":{"observed_at":"2026-08-08T16:45:17.785395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.763389Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":"29f446e0-fe4b-4f78-b22a-74941cccbd1b","year":2018},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.655612Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:f106ddd41ddc66b910acb0545c23fa0d7fbe50dba5ce7423eb3e0c9d0212bd8a","observation_id":"e5923bd0-637d-4b4d-b9a4-2a304d0d1442","resolution":{"observed_at":"2026-08-08T16:45:17.768383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:45:17.746712Z","title":"Learning adaptive control of a uuv using a bio-inspired experience replay mechanism,","venue":null,"work_id":"f5d79e0d-94fd-41c6-a171-83349a2e5a10","year":2023},"citing_paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T16:45:17.660092Z"},"links":{"citing_paper":"/paper/2502.06113"},"observation_digest":"sha256:79459055e43e7aa671f8cf9c16188281482db77adf9403caddbdaa5d475ef23a","observation_id":"842c66fc-812d-4e2c-9a54-2e812af0fe69","resolution":{"observed_at":"2026-08-08T16:45:17.751603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06113","last_updated":"2025-02-10T02:47:33Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T23:23:46.787088Z","submitted_at":"2025-02-10T02:47:33Z","title":"Towards Bio-inspired Heuristically Accelerated Reinforcement Learning for Adaptive Underwater Multi-Agents Behaviour"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":43},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2502.06113."}