{"as_of":"2026-08-07T23:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8deea99fc12e31e15b3511852245649f0efcdfb82eb03d416fdfd4dd273625de","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:03:54.185019Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.03963/citation-record","integrity":"/paper/2606.03963/integrity","json":"/paper/2606.03963/citation-record.json","paper":"/paper/2606.03963"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.07243","last_updated":"2023-03-13T16:15:42Z","snapshot_observed_at":"2026-07-06T15:02:40.704180Z","submitted_at":"2023-03-13T16:15:42Z","title":"Sim-to-Real Deep Reinforcement Learning based Obstacle Avoidance for UAVs under Measurement Uncertainty","version":1},"cited_work":{"arxiv_id":"2303.07243","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.07243","snapshot_observed_at":"2026-07-02T03:26:29.343828Z","title":"Joshi, D","venue":null,"work_id":"3479200f-7ee7-4f00-9720-07c737b15e3c","year":2023},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"cited_paper":"/paper/2303.07243","citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:a5363df5f8db93302d4e55b826d65683485c70787a0a3db382d92ae1edab06cb","observation_id":"871cf118-69e7-4651-9e2e-4a75d0078055","resolution":{"observed_at":"2026-07-02T03:26:29.346422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"W ANG, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:5d3aaadc14b3ec1f843eea6a29027ba500d02ab6a4643f508091167100088f69","observation_id":"ef190c82-393b-489b-a046-3df6bb59ac1f","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:d6e8a00df21e7293d33ccfe6138c51e301a4ba73b7599231fa979bec3ebecf75","observation_id":"20e938b5-48c6-489e-b8ef-3ffbd64dd179","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:d43ec1fe555970e34311b596ce9bfad4b1876ca04f8307a93985345c79352b40","observation_id":"47021b31-b007-4f96-8a3c-9ab43765867d","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Sadigh, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:816b6065e75498733757cbdadf8619dd848fb83003d4c09b4087d6f6147f79ef","observation_id":"5686bb34-5bc1-418c-b2bc-712acb4a53f8","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Bıyık, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:a5eb2c2f55029729def79e70a5cd58a311b2dd30b6aeb89f5381aa0747f84929","observation_id":"6be3d70a-4a1c-4414-b309-4e77ed25849f","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Liang, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:9145d86b1977d25a2a01d525fe5fa0de29b434aa645df2d05f037856d76e10c1","observation_id":"111eb76f-6768-4b1a-afcc-078ea7e02fc6","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:3343d5eaaf4c4ef47ab986900e742d9211ee412e7015b34e6147ab69b45e9ab9","observation_id":"5c6d4373-d173-4728-a85b-8a5754bcd145","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:856dc673c646dc0d664d6fd5857c9315ca1252998f27bdf923b7038420855182","observation_id":"0cbc2f94-14f0-413f-9e3b-cfe1e132cb71","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Mill ´an-Arias, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:b4a2f71bee5753f2c1c85bfbc2ceda79502386ce5673ed38e3cc701bc3d42982","observation_id":"7044cc48-c7c8-457e-ab7c-04b93b2d7c7a","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:173a1406861dbce433898d6fc4ec03e88aea59718820079f857002b091b927d4","observation_id":"942a4be4-c320-4265-9062-d5d24690aa7e","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Devidze, G","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:81f35550f0db9ef4aa35819e1388fd42b9e3c1c18028586299136f71db654020","observation_id":"c4176a5f-bcb8-41c7-8e42-3dba430a69e7","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:0c9e4d7620072e1e3b7f5592e07999cad01b5f3e11aa6c457023740b2fb204c9","observation_id":"ba4bb9db-bdcf-46bf-ab43-a72b432051fe","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:0895e69bccbb8bdacb4786fbd6ffbe0e2d55a6e688e5b08db303de0dee3ba32e","observation_id":"e96c6407-5986-4661-8ef0-6b48b78dbb18","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:687713fc73bce42892103be53547ebba260d52d705bff4ba48ac0769c90b80f0","observation_id":"5e171a60-d64d-45e7-9cbe-5b8f5c4a0bc8","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Venuto, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:94f3e12a928897887faf478b9dd9444d245f085a2d06abed2c0eed762cd30406","observation_id":"12d88875-2be1-49f8-89de-add60ecc7900","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.00675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:53:50.326556Z","title":"RoboReward: General-purpose vision- language reward models for robotics","venue":null,"work_id":"cc6075e6-5787-43d5-a8f1-6bb63ddca382","year":2026},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:8cf5e9849107044909cfef01a70db32aa30623d670a7eb2b0387e49a1ec34b84","observation_id":"fd6eece2-cc46-4388-a619-b89680570d10","resolution":{"observed_at":"2026-07-02T03:26:29.342667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Zhang, H","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:194f65d2a0a5e24f9849da531651489ddbbd6b66254d333a53c357cef66404c0","observation_id":"add91cbe-8919-44dd-bdab-93e8c759c185","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:3c72e4acf316ceaba8143957a320a7062c175c5e3f5c3f9e0dee5c1a3a58b401","observation_id":"e30ed320-ac69-48f2-b193-5e82d5564596","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04206","doi":"10.48550/arxiv.2510.04206","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentrl: Scaling agentic reinforcement learning with a multi-turn, multi-task framework","venue":"ArXiv.org","work_id":"5d14b2f1-ee1c-407d-8b3f-4e653c4781ad","year":2025},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:0914b0a4be817164668d220476c9a02c88cb207972689a1a453ef5bb3d4c5f46","observation_id":"b523f900-d17c-41b2-ac40-5cc185fbd853","resolution":{"observed_at":"2026-07-02T03:26:29.327123Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11425","last_updated":"2025-06-20T23:32:06Z","snapshot_observed_at":"2026-08-07T18:07:24.589112Z","submitted_at":"2025-06-13T02:46:53Z","title":"Agent-RLVR: Training Software Engineering Agents via Guidance and Environment Rewards","version":2},"cited_work":{"arxiv_id":"2506.11425","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11425","snapshot_observed_at":"2026-07-03T20:18:55.557008Z","title":"Agent-rlvr: Training software engineering agents via guidance and environment rewards","venue":null,"work_id":"8004998c-b315-4791-bd76-2c438beeb63e","year":2025},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"cited_paper":"/paper/2506.11425","citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:24e2805c3eb770f0e20d404ed93b3cbfa57d6e1fb896e52dbf6e40b8daf9321e","observation_id":"b55f1ba7-cf7d-4b55-b1b0-60b03a905c3b","resolution":{"observed_at":"2026-07-02T03:26:29.320110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.22154","last_updated":"2026-04-28T11:53:16Z","snapshot_observed_at":"2026-08-02T11:40:50.970608Z","submitted_at":"2026-01-29T18:59:52Z","title":"Exploring Reasoning Reward Model for Agents","version":2},"cited_work":{"arxiv_id":"2601.22154","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.22154","snapshot_observed_at":"2026-07-08T20:05:34.027834Z","title":"Exploring Reasoning Reward Model for Agents","venue":"cs.AI","work_id":"3bbd279d-eee5-44dd-a4b0-085789b1a824","year":2026},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"cited_paper":"/paper/2601.22154","citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:33cc1b1a493ab4c9c5ffe66f334fb729a47a2a2b962970fcd4b2aa66dc078200","observation_id":"f7724ba0-2e11-44cf-a3a8-c3087742c8a5","resolution":{"observed_at":"2026-07-02T03:26:29.327537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.24636","last_updated":"2026-07-01T11:59:43Z","snapshot_observed_at":"2026-08-07T23:16:25.258712Z","submitted_at":"2025-10-28T17:02:46Z","title":"OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2510.24636","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.24636","snapshot_observed_at":"2026-07-02T03:26:29.328767Z","title":"OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning","venue":"cs.CL","work_id":"cd2b8a5f-5d71-4806-b44e-e889c42f37f7","year":2025},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"cited_paper":"/paper/2510.24636","citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:aa5d3adfb8722f737d4cf7b85b92df3e46c26f645041bf0e9656e39231f598e0","observation_id":"2fa5c8cd-2e1d-4666-a6ab-e196f6207750","resolution":{"observed_at":"2026-07-02T03:26:29.330841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.17931","last_updated":"2026-07-01T16:44:57Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:11:09Z","title":"LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent","version":4},"cited_work":{"arxiv_id":"2604.17931","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.17931","snapshot_observed_at":"2026-07-08T20:05:34.035966Z","title":"LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent","venue":"cs.AI","work_id":"63ab55de-fed1-4222-b665-5b6b9bb28ca0","year":2026},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"cited_paper":"/paper/2604.17931","citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:1dacd8a2f1897ae82f4c9ff29c8468422ae790c6dc592752f24ec888941ef454","observation_id":"2687e264-44eb-4af6-a54a-cd201819304c","resolution":{"observed_at":"2026-07-02T03:26:29.341523Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:c186f9bfcd64bedb1c8aaed34fdb9aa4fc507c4ed2f050c8eb62dcb79d5821df","observation_id":"bde6fc1e-dbf8-448b-b715-2f10a959f5a0","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Panerati, H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:44632ff2affb58f25165634ef94384e185e315e95e223aca9c758556c85d07eb","observation_id":"3e6aaadb-c3ae-4f80-8428-88469ee2ecb6","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:d9d75db60c805e4e9f5f487f8410fcd2b3e5d2a54e69db2682e6205ff8a41245","observation_id":"15a70218-5469-4832-8cb2-c6c09f17222f","resolution":{"observed_at":"2026-07-02T03:26:29.339578Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Kaufmann, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:4f95015e17f1283ff172cc02b56848737822a57795254ea7cca47ed35cf889eb","observation_id":"8f8a7688-7ec4-447d-ae25-028fde444e0a","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:fbb41a1ff091493158aeda167fa10fba5784a12f45f9b40f7598f4d1c8df04a3","observation_id":"c4e61c3d-acde-4712-9f2a-8c49b1e4e07c","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Ahmed, N","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:c82ff97e5ad8d15b3a99b46f3cbc18a36494ec86ce8bd2c1f113cac882d5ca55","observation_id":"550abb45-52a2-46de-8df5-c1691622811f","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:03:54.185019Z","title":"Eysenbach and S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T10:03:54.185019Z"},"links":{"citing_paper":"/paper/2606.03963"},"observation_digest":"sha256:d6050b35fe9650f6ea5bcef085df74d7adfdca4e59a714644b5fbbef000e6706","observation_id":"9b2f8ec9-8149-4b2f-a7fe-f40994a5b9d6","resolution":{"observed_at":"2026-06-28T10:03:54.185019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.03963","last_updated":"2026-06-09T15:09:32Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-05T23:50:00.007370Z","submitted_at":"2026-06-02T17:50:15Z","title":"AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2606.03963."}