{"as_of":"2026-08-08T18:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6cd43e69360cf9485a1c253c64708f769033d32c416164fd6750148de2e63805","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:21:02.781429Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.08566/citation-record","integrity":"/paper/2602.08566/integrity","json":"/paper/2602.08566/citation-record.json","paper":"/paper/2602.08566"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.418535Z","title":"Wehner, Journal of Comparative Physiology A189, 579 (2003)","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.418535Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d14749c20a291311e4a8d9afc8801c844794ed35924fc79084b536f1cc08490e","observation_id":"ba70da2a-9a00-458f-a364-bbfa0dc1ab9c","resolution":{"observed_at":"2026-08-03T03:21:02.418535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.490027Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.490027Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:9e0e63baabceb722a73e30705caf4f9252a4da9d44f2df7a043c93c1148e7194","observation_id":"f48b62cc-6f26-48ca-b8f6-b1a28e13e937","resolution":{"observed_at":"2026-08-03T03:21:02.490027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.530168Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.530168Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:295805f88b94bc9d9c9f361ef1c5cfd0a7f7396971c75f3f6cf58f2e60371818","observation_id":"d2d37256-263a-4cd5-af6d-107139c28dad","resolution":{"observed_at":"2026-08-03T03:21:02.530168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.579754Z","title":"Paramanick, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.579754Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d1441bc38364b74a392ceee09dfefcfd040711e00419f23a8dc696f8e83d61c8","observation_id":"7c60987d-a29e-4c23-b80f-e5a472b39b83","resolution":{"observed_at":"2026-08-03T03:21:02.579754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.583910Z","title":"B´ enichou, M","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.583910Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:c58529a7df9f5943640f7d5dc8e124a1f74dc2f08bd94a26d33411fbecb2f34e","observation_id":"38594199-f3fd-46d0-80b9-eea4b80a2aee","resolution":{"observed_at":"2026-08-03T03:21:02.583910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.587969Z","title":"Bartumeus, M","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.587969Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:5022d8cc39d0d5f6fbf04aa9003af8899fce5d225a79ad110b84df691ef46281","observation_id":"8884e266-aae8-4c3a-be51-e755d351393d","resolution":{"observed_at":"2026-08-03T03:21:02.587969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.592219Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.592219Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:dcb6ba34d81fc9d010631564d251100b2c8f7067e1cda76a4969ee806c252e5d","observation_id":"3097e301-97d3-4caa-b84e-2bd48e46bf02","resolution":{"observed_at":"2026-08-03T03:21:02.592219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.595776Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.595776Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:49e9ec27d4cf2ed55a049dfe29a9ab204d3584d68e236832c6f1caf6973d9da2","observation_id":"71c42c48-cea6-4d7f-adc7-34870ca3adf4","resolution":{"observed_at":"2026-08-03T03:21:02.595776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.599276Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.599276Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:0790e187764b033b94c4668dc51d1ec910b39c7d04d9b7e60abaececc06c2e73","observation_id":"bbf5f3f7-1131-4124-aa88-79e591f560fd","resolution":{"observed_at":"2026-08-03T03:21:02.599276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.602665Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.602665Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:5de35e7ab62b48a6ebcd340b6e71ff0a08e0072f7b925ebad2e42b08ff42880b","observation_id":"c31b8282-0796-4488-9d78-1a92f8772ca8","resolution":{"observed_at":"2026-08-03T03:21:02.602665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.606394Z","title":"Christou and A","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.606394Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:1869c44627e3a4b1cbdfc79ccea7cbab62d1839a1836059bce327872743c061f","observation_id":"88ba663e-5ee5-4d71-b15f-f64acdbbdb90","resolution":{"observed_at":"2026-08-03T03:21:02.606394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.610106Z","title":"Pal and V","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.610106Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:401fd3f0cfffae56c54d4e1e5eea844f69e5642a4d60de2186726178bc6281ea","observation_id":"a14bf02f-acd8-4718-8925-a09f2fee640e","resolution":{"observed_at":"2026-08-03T03:21:02.610106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.613615Z","title":"Durang, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.613615Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d11a5db15e2b12a3624a288b5b304e5ccbcf3f166a1d5c6f591bc2f5c99729e7","observation_id":"a3e6930b-8db1-4ba7-b40b-f34ba77a1f1d","resolution":{"observed_at":"2026-08-03T03:21:02.613615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.617004Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.617004Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:68c910c1fb2254ac255688856ea18cd325689a4ed82be5aa357eaa1b68164d65","observation_id":"13b07fc9-dc9d-42a2-8ac1-9cfb12bc90e4","resolution":{"observed_at":"2026-08-03T03:21:02.617004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.620343Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.620343Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:01204fb4cbe49952cf554d9e8486911fbbde97d324eb9e2483b423b36902cf25","observation_id":"52ca306e-aaca-4d60-8f82-b8820b9eec41","resolution":{"observed_at":"2026-08-03T03:21:02.620343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.623885Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.623885Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:4e03310fdcbe3112f07643959d6cba48506df67621d82c0ef7a58e97fc5ba004","observation_id":"b7ed33ce-26ad-465a-8a0e-bcdf018585ad","resolution":{"observed_at":"2026-08-03T03:21:02.623885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.627440Z","title":"Bartumeus and S","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.627440Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:c00410863a0865791ee4db644e91bf843da8fdd7ef5fa381b592262ddf15d47a","observation_id":"c261002a-a57c-447c-b387-13e2364b8115","resolution":{"observed_at":"2026-08-03T03:21:02.627440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.631676Z","title":"Botvinick, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.631676Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:3e29f2595187c93df39a541bfce6d03bdd2bf2e09afd87e31d5c72faa9938e32","observation_id":"04932f98-bc85-4330-9b7f-5dccbbc58507","resolution":{"observed_at":"2026-08-03T03:21:02.631676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.635218Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.635218Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:afbc24ef7068ec29cc58de49e120697b42e998f830f6c3fe05ebaf8c57bf3b6d","observation_id":"2a4f9a9c-90c0-450b-89b1-351dc182ba17","resolution":{"observed_at":"2026-08-03T03:21:02.635218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.638823Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.638823Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:18686df348f50729b273b16f468f3d30ae1be97700c166f4b58a810e2bdc5063","observation_id":"a635cb3f-f671-4e44-8f4b-9871002f1a6a","resolution":{"observed_at":"2026-08-03T03:21:02.638823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07712","last_updated":"2024-12-03T16:17:32Z","snapshot_observed_at":"2026-08-02T19:29:16.909055Z","submitted_at":"2024-08-13T23:08:06Z","title":"Introduction to Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07712","snapshot_observed_at":"2026-08-03T03:21:02.642688Z","title":"Ghasemi and D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.642688Z"},"links":{"cited_paper":"/paper/2408.07712","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:f1f0d47ff639d4859f622571a3fc4d2d43cd54af187f629df1477448073bc4ac","observation_id":"8a27ddae-0efb-42ce-a388-cdb17ff528a1","resolution":{"observed_at":"2026-08-03T03:21:02.642688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.03037","last_updated":"2017-02-10T01:48:40Z","snapshot_observed_at":"2026-08-02T16:32:14.415500Z","submitted_at":"2017-02-10T01:48:40Z","title":"Multi-agent Reinforcement Learning in Sequential Social Dilemmas","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.03037","snapshot_observed_at":"2026-08-03T03:21:02.646437Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.646437Z"},"links":{"cited_paper":"/paper/1702.03037","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:3b67c46279d1f041dbd9c7ce8f1e55e1d52c6293d8839ed657520bf0674f22ca","observation_id":"dc6750eb-bea6-4437-be23-d16624cb21e2","resolution":{"observed_at":"2026-08-03T03:21:02.646437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10603","last_updated":"2022-03-20T17:24:47Z","snapshot_observed_at":"2026-07-06T12:50:01.067926Z","submitted_at":"2022-03-20T17:24:47Z","title":"Model-based Multi-agent Reinforcement Learning: Recent Progress and Prospects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10603","snapshot_observed_at":"2026-08-03T03:21:02.654618Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.654618Z"},"links":{"cited_paper":"/paper/2203.10603","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:41648f0ef4fd4f9c1573663a69132e2e85e78ed8fb7b61113c0e44a927fb42a6","observation_id":"d5412036-8f06-4b17-89b5-f3f69e69bb85","resolution":{"observed_at":"2026-08-03T03:21:02.654618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-03T03:21:02.658487Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.658487Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:f638fd66365e5e7952fce96fecb21b8baed05044b928afaebf150454d0e74b95","observation_id":"901848d3-df23-40e7-9960-f293114ed597","resolution":{"observed_at":"2026-08-03T03:21:02.658487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.662155Z","title":"Zhang, Z","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.662155Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d110bed850e2e81d4161c28361ce6136378a6f3cc72f097563dd40894ad5ff41","observation_id":"fac08efb-2bf9-4cc7-8a26-7d27321ac9f8","resolution":{"observed_at":"2026-08-03T03:21:02.662155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.665788Z","title":"Now´ e, P","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.665788Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d7b00e475d11710a9bf7d9b9e61b09943abc7e205cc177e38c791e67e8478dee","observation_id":"b5f047af-8348-469c-9167-bc125f1f7d17","resolution":{"observed_at":"2026-08-03T03:21:02.665788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.669585Z","title":"Tuyls and A","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.669585Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:33a2df3d7d9f261be7f3e65fd2bdf23fc9ee789335b2702b78c7bb3118fa29cd","observation_id":"96469a34-7172-4c01-ba0f-8fce6dda3f6b","resolution":{"observed_at":"2026-08-03T03:21:02.669585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.674184Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.674184Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:e27b387988b424d9458244453eead1cfde9b058ea65bef1c38bb57c41dd189ed","observation_id":"416f9b6e-f6d4-4531-87ed-8a394a8bb092","resolution":{"observed_at":"2026-08-03T03:21:02.674184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.678250Z","title":"Semwal, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.678250Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:6a183dd8fd51123b7729d311134f774cc027cafe9449f1cc93831dd727167e8f","observation_id":"f01cde40-d366-4519-9565-1bb909e2712d","resolution":{"observed_at":"2026-08-03T03:21:02.678250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.682125Z","title":"Jena and S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.682125Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:99c9a41fc86012cb4cb5c6370fe832034c487a67f3eb4c9d23fd0c9379204910","observation_id":"5f1def29-69cf-4465-ad38-baa534ef5ea8","resolution":{"observed_at":"2026-08-03T03:21:02.682125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.685939Z","title":"Pin¸ ce, S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.685939Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d131c786441f4c5ffc63291db688d7622d50bd6a1b0b3b9683ceab0d79f54656","observation_id":"de54e290-de23-4d8c-9bde-986e0c252d08","resolution":{"observed_at":"2026-08-03T03:21:02.685939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.689609Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.689609Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:f68346afc45bc8f78fb47ccad10acb07ccbe81331e35446c623647dfe1d95dd6","observation_id":"e130fbab-cba9-4903-8d0a-150f04b8e1a8","resolution":{"observed_at":"2026-08-03T03:21:02.689609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.693200Z","title":"Buttinoni, J","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.693200Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:4ab3c6edcd4cef54bb1e5014a9212f4d0b39d273e7b83c7e41def3de0626207d","observation_id":"78207bd0-10e3-43a6-88b6-fac6836927f3","resolution":{"observed_at":"2026-08-03T03:21:02.693200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.696725Z","title":"Brambilla, E","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.696725Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:5460b6c74af484d96919eb0684151140340c8a24bcae0bc8d4078058004b9705","observation_id":"ceb95ab8-097e-4f14-bd31-c2067e209203","resolution":{"observed_at":"2026-08-03T03:21:02.696725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14783","last_updated":"2025-09-04T07:01:56Z","snapshot_observed_at":"2026-08-06T18:27:44.799069Z","submitted_at":"2024-11-22T07:52:28Z","title":"Segmenting Action-Value Functions Over Time-Scales in SARSA via TD($\\Delta$)","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14783","snapshot_observed_at":"2026-08-03T03:21:02.700782Z","title":"Humayoo, arXiv preprint arXiv:2411.14783 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.700782Z"},"links":{"cited_paper":"/paper/2411.14783","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:ddf5981c03bfed990074ff0418bd37dad9c4caab8a85a61f91bfc727cf87aec8","observation_id":"28a6558c-221a-4e78-b565-12c62aa4db8a","resolution":{"observed_at":"2026-08-03T03:21:02.700782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.704844Z","title":"Mohan, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.704844Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:1e9ab8ceae65f8bda63b66b8564c4f496d0357115b18a1ea37d9e1f07c7951c2","observation_id":"b5d7693e-a081-4db5-9499-b854e5c1999c","resolution":{"observed_at":"2026-08-03T03:21:02.704844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-03T03:21:02.708590Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.708590Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:7dad392c35fa24870807190da8b28275f2213fee4048ab09f11a33e41b1ccfeb","observation_id":"dcf9a934-4e5b-4c59-85e4-bbb89193ca44","resolution":{"observed_at":"2026-08-03T03:21:02.708590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.712538Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.712538Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:1c83759c1664c410517da92c9330f31c268d89a9bc73bf4da9ac60869b7c248e","observation_id":"21930652-da9e-42d1-b0d6-dad31ede3c5c","resolution":{"observed_at":"2026-08-03T03:21:02.712538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.716172Z","title":"Konda and J","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.716172Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:cd52063c2f65047d5951e5bff747baa186691f088baa1228acabac74317afa9a","observation_id":"5701c924-c925-4a78-95cb-c5080433e2ed","resolution":{"observed_at":"2026-08-03T03:21:02.716172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.719524Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.719524Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:e542b33e98278e24aeeee26f8d4c50badcf972064fefcc8c22cd70ad72c8cd15","observation_id":"7f682529-644e-40a8-9584-cdd6332d079e","resolution":{"observed_at":"2026-08-03T03:21:02.719524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.722903Z","title":"Jia and X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.722903Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:92d57a10c7893ae4f007a556186f7f47627ec29ff9dc7683bdfdba4a3ff92e91","observation_id":"a1657724-342c-4d15-ae41-89c21f5d2f15","resolution":{"observed_at":"2026-08-03T03:21:02.722903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.726235Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.726235Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:6c8b73d43ee26b8ff30db4408d58eee178482b5fd578bec7f54b2b7065e6049c","observation_id":"81953441-114f-4bc7-a31b-6193beca472f","resolution":{"observed_at":"2026-08-03T03:21:02.726235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.729823Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.729823Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:c2c0110fb901037272fa2c5ecf18d98feaf58734c55bc46db598725522ffd33e","observation_id":"5f14ac31-92a1-4ef9-bf2d-f077a8aed044","resolution":{"observed_at":"2026-08-03T03:21:02.729823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11330","last_updated":"2025-03-14T11:57:51Z","snapshot_observed_at":"2026-08-07T17:04:12.106688Z","submitted_at":"2025-03-14T11:57:51Z","title":"Learning to reset in target search problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11330","snapshot_observed_at":"2026-08-03T03:21:02.733124Z","title":"Mu˜ noz-Gil, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.733124Z"},"links":{"cited_paper":"/paper/2503.11330","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:cf1a5bf66e9833328a9015ca5c3894181017214ada3504badb5131fa48440995","observation_id":"5318a9fb-180f-4339-a1ae-bb820c00e4dc","resolution":{"observed_at":"2026-08-03T03:21:02.733124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.736582Z","title":"Kormushev, S","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.736582Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:abfb5f5942b9b566d9b033f3d397847d2efb98b35ecd6a8c22e58e9e35ffd1d9","observation_id":"22a1d8af-34de-4b22-b248-3e4ce166aaee","resolution":{"observed_at":"2026-08-03T03:21:02.736582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.739937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.739937Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:a2fae21389f8055ce06208dd02ff61f49086b45237b9ada90c88ce9904108e14","observation_id":"d97b1401-e373-48f3-bbcf-d9a06a18a572","resolution":{"observed_at":"2026-08-03T03:21:02.739937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14360","last_updated":"2022-09-28T18:45:16Z","snapshot_observed_at":"2026-07-06T13:57:28.504144Z","submitted_at":"2022-09-28T18:45:16Z","title":"Robust Lattice-based Motion Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14360","snapshot_observed_at":"2026-08-03T03:21:02.743341Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.743341Z"},"links":{"cited_paper":"/paper/2209.14360","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:fc296a7c61b0f7ac5b38c060be6bd81431b098c69649448efcf200e78a8f9fff","observation_id":"b096afa9-e761-4eaf-ba66-5d903ec82ae9","resolution":{"observed_at":"2026-08-03T03:21:02.743341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02350","last_updated":"2025-08-19T08:21:28Z","snapshot_observed_at":"2026-08-06T04:55:31.020720Z","submitted_at":"2025-08-04T12:35:07Z","title":"Adaptive Lattice-based Motion Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02350","snapshot_observed_at":"2026-08-03T03:21:02.747437Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.747437Z"},"links":{"cited_paper":"/paper/2508.02350","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:271182be453364e8b8c9d65b431f79637dc8cb192c47edc677d3d26e679f4010","observation_id":"4bbee675-c272-4dad-b985-77f4b718e335","resolution":{"observed_at":"2026-08-03T03:21:02.747437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.751357Z","title":"Chepizhko, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.751357Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:4507c2ccbc2420092ffad95e42ca92f0be52820510faf8427cd7f298632a484b","observation_id":"8f7bd81b-c169-4041-890e-8b02f2a05054","resolution":{"observed_at":"2026-08-03T03:21:02.751357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.754768Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.754768Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d9f5a6de8fa2d64f62f4ec55aea8133579530aade62541683f7bf475fddec246","observation_id":"5835737b-fc29-494a-b34e-298974256cf5","resolution":{"observed_at":"2026-08-03T03:21:02.754768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.758588Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.758588Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:2ccd744dd5225319189fede15f8f3d268bf8a6e2bed55424cf8fe9d097b38dc4","observation_id":"a46987ae-0266-460e-b92f-f4443abe0aaa","resolution":{"observed_at":"2026-08-03T03:21:02.758588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.762023Z","title":"Reddy, A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.762023Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:d0951774f85cd5503e4cd30e08dac646c3fbff7ea972fe849c00f309f990a6a0","observation_id":"8d4a408a-ed08-44a7-8704-0abfecdb4388","resolution":{"observed_at":"2026-08-03T03:21:02.762023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.766598Z","title":"Kumar, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.766598Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:953c76bfa71f1651ae9e89084fad49b477e4678f8a04f3c154683633963bcc09","observation_id":"87e10e95-1faa-4142-a0e4-0ae4992f429c","resolution":{"observed_at":"2026-08-03T03:21:02.766598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.770521Z","title":"Pramanik, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.770521Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:72dc19f91b6955c3712da407b9687e7969e633092d2baeda8b33516b08726f0f","observation_id":"3111ac36-ec7c-4093-a11c-a26878439de2","resolution":{"observed_at":"2026-08-03T03:21:02.770521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.773819Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.773819Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:42f6c2b99f36bafd7b69256a6b4638ae18d968f7a221174ebe4ac30c7a5bf860","observation_id":"90902865-21ba-4d3a-9e74-8f76c737d220","resolution":{"observed_at":"2026-08-03T03:21:02.773819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.777944Z","title":"B¨ uhlmann, K","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.777944Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:e0108ac7dbb7aaa3e0393119015f634a126c76210a695b1924d2bc13b0081e56","observation_id":"e6de6710-dd11-4c0a-ab84-836b639b1f83","resolution":{"observed_at":"2026-08-03T03:21:02.777944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:21:02.781429Z","title":"Alonso and J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.781429Z"},"links":{"citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:e4aefc2ec33f192be9eb642c3643ca387d7c506c345466bd05d9dd813ded04a3","observation_id":"b6f0522f-d3d0-45f6-ba4d-e592aa4eb00b","resolution":{"observed_at":"2026-08-03T03:21:02.781429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","latest_version":2,"primary_category":"cond-mat.soft","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2602.08566."}