{"as_of":"2026-08-11T12:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9aa637d6ba99869bad63c31a5c52d2859021cfaf4f5ae35e68367fbdfbbaeea","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:15:26.334084Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16382/citation-record","integrity":"/paper/2507.16382/integrity","json":"/paper/2507.16382/citation-record.json","paper":"/paper/2507.16382"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.555945Z","title":"Reciprocal col- lision avoidance with acceleration-velocity obstacles,","venue":null,"work_id":"96e00504-4883-42cc-9de9-3e04deea081f","year":2011},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.268569Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:e65258cb444f73c18fc6c8cc4bbd4b6dfbb0a5cecea10d5dd258e6bed1149f60","observation_id":"e195e1b9-113b-4fca-91b4-2eb09ea49754","resolution":{"observed_at":"2026-08-06T15:15:26.558637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.548155Z","title":"An improved artificial potential field method for path planning and formation control of the multi-uav systems,","venue":null,"work_id":"d723b725-9868-4b5c-8dc3-7c57cc030e14","year":2022},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.271765Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:b945bcf355b2cecb952e1e489ecfb0f80745fc9a0556dc322364d6fb819ed9f8","observation_id":"eac33085-bde4-4183-99bc-857d5e599711","resolution":{"observed_at":"2026-08-06T15:15:26.550967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T15:15:26.274545Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.274545Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:1938bfd0fb1ad24206b2fb575185c747ff58d134d6b6874a005b08b7dee9e842","observation_id":"01ac2bd7-99aa-45c9-a3c8-e43bd7c0fd52","resolution":{"observed_at":"2026-08-06T15:15:26.274545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.540555Z","title":"Impala: Scalable distributed deep-rl with importance weighted actor-learner architec- tures,","venue":null,"work_id":"cb61bd48-8d06-453d-be8b-888ba5f0702f","year":null},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.277566Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:dade2fa162e34d2c3fecafab2735f84721f30c0b72d0417e270e417297d3a064","observation_id":"040d2581-4b1c-481d-a71f-bd479012a1d2","resolution":{"observed_at":"2026-08-06T15:15:26.543274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.532376Z","title":"Monotonic value function factorisation for deep multi- agent reinforcement learning,","venue":null,"work_id":"778157ea-7750-4a09-bc3b-2d23667c5b74","year":2020},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.280155Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:42df91be098dbe915d14a36799a159c280cc31d3e28c8d400af906c07c2a323d","observation_id":"4973b4bb-ad7a-4e4d-a47a-e69496da2a79","resolution":{"observed_at":"2026-08-06T15:15:26.535269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.524072Z","title":"Grandmaster level in starcraft ii using multi-agent reinforcement learning,","venue":null,"work_id":"3b8ae3c8-9b97-4c9a-93cc-38222e97de27","year":2019},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.283015Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:96a8468d4c55de78e781e2c9a18dedf983c27106397e0df22204ddeed8bf62d8","observation_id":"5d936f68-df05-426a-8253-1694e47db49a","resolution":{"observed_at":"2026-08-06T15:15:26.526744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-06T15:15:26.285767Z","title":"Dota 2 with large scale deep reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.285767Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:e721d41ea821776eb68ddfaad8c8fda29d636346a74f7f7f62906c882ff5846a","observation_id":"b16eff6f-b9ae-46ba-b876-f07722f1998b","resolution":{"observed_at":"2026-08-06T15:15:26.285767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.516438Z","title":"The surprising effectiveness of ppo in cooperative multi- agent games,","venue":null,"work_id":"64701f6e-780f-4c53-961c-3a54e9b5bf42","year":2022},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.289200Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:ebad7ec351562b3e4de436b9853595248742c5f9eb6f7c17000d20196c2ebf45","observation_id":"8134c526-2ee1-462e-891d-c25a67816111","resolution":{"observed_at":"2026-08-06T15:15:26.519109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.508124Z","title":"Formation control with collision avoidance through deep reinforcement learning using model-guided demonstration,","venue":null,"work_id":"0b96216c-c9c8-4acd-b82d-946fbd0df8ca","year":2021},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.291635Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:8d84598b34e31d4ad724d33632477d0d27f48282227608e26f5452cc52b1d882","observation_id":"bc39f2c1-3a29-4337-9038-e53a97d4e4ee","resolution":{"observed_at":"2026-08-06T15:15:26.510870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.500070Z","title":"Relative distributed formation and obstacle avoidance with multi- agent reinforcement learning,","venue":null,"work_id":"ab214ae7-5d49-4f6b-915c-3915c37af9f9","year":2022},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.294113Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:2f5766120f9685751ddc7b6f2be6a2bae5c587562a533e3300455cc7cd43d190","observation_id":"5fbe4ceb-82d6-4c64-8453-c37a0fee59c2","resolution":{"observed_at":"2026-08-06T15:15:26.502992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-06T15:15:26.296759Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.296759Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:c1168d77e4c83cd3e7bc64475dec243f5cd93d04993e2d7cdac535a1b2105477","observation_id":"eab2090f-48d2-499d-85f6-56a35751e303","resolution":{"observed_at":"2026-08-06T15:15:26.296759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.492190Z","title":"Executable code actions elicit better LLM agents,","venue":null,"work_id":"9a9d7407-b823-4e31-a01a-1bb38acf1933","year":2024},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.300155Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:32364e1da17e198c05c7a90d4114242ced7b4841db35612f31a8424e05eb5e94","observation_id":"1cb9f391-230a-41ac-83be-47446074ee81","resolution":{"observed_at":"2026-08-06T15:15:26.494976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.303082Z","title":"Boosting efficient reinforcement learning for vision-and-language navigation with open- sourced llm,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.303082Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:066e2995d7465d3fc5deff06b6084e7e75389b9fc8c21787faa3e7a4a62e028d","observation_id":"a8ad1ec2-20e2-4550-be8c-87121bcdc8cf","resolution":{"observed_at":"2026-08-06T15:15:26.303082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.479130Z","title":"Text2Reward: Reward Shaping with Language Models for Reinforcement Learning,","venue":null,"work_id":"2679f6a5-a0e7-471f-bdcd-74a6a1793675","year":2023},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.305998Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:1d9ea0f8e90fe3355c70b0e636ae775f61a4a85b52716a74f32f6b8d42b7c294","observation_id":"7c7e1473-ebcf-4eea-9b60-3d86c85bb14d","resolution":{"observed_at":"2026-08-06T15:15:26.481824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-08-06T15:15:26.308611Z","title":"Eureka: Human- level reward design via coding large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.308611Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:6b1ca83cc1b22a94ca25afb208956a3051097b845d87af710d3a44f615466d08","observation_id":"9cd4743c-7e2f-42a1-a305-96c145e0a1db","resolution":{"observed_at":"2026-08-06T15:15:26.308611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.471327Z","title":"Adaptive finite-time tracking control of nonholonomic multirobot formation systems with limited field-of- view sensors,","venue":null,"work_id":"1eab30a8-7c8d-4948-8735-12c6c68ab778","year":2022},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.311413Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:3707c33e9789145f03dc0a20e267f99917aac21ed6140e1e51b399457508ecb2","observation_id":"38724d0b-7726-4a2d-93ea-21d30620900d","resolution":{"observed_at":"2026-08-06T15:15:26.474042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.463086Z","title":"Racer: Rapid collaborative explo- ration with a decentralized multi-uav system,","venue":null,"work_id":"6c944096-1be4-4963-9161-b73f8fef36fb","year":2023},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.314060Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:fd46c56551522f85a25a7dd8addc81378e0c54f31bb495113e94a5a338775678","observation_id":"f4af54e6-f34f-4c46-b4c3-e84ce22bfdcc","resolution":{"observed_at":"2026-08-06T15:15:26.465655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.453009Z","title":"An overview of recent advances in coordinated control of multiple autonomous surface vehicles,","venue":null,"work_id":"b485f979-1769-4243-893e-08138ba015d3","year":2021},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.316545Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:cb32b65860ee53a69c6a395269d49e1a3a81b63ff76a33ef32c589fab2059a6c","observation_id":"f69ba60d-d882-4553-ba42-a64c19535799","resolution":{"observed_at":"2026-08-06T15:15:26.456447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.444500Z","title":null,"venue":null,"work_id":"dcf2af34-ab32-4add-80b5-21791f88a4a1","year":2014},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.318923Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:fcaad44a6684e7b75c884130e7c0b0aafc75adc6da92298e041d4d8a8101ac7e","observation_id":"7a4c6c52-a0eb-4c66-b473-712116e2cf7b","resolution":{"observed_at":"2026-08-06T15:15:26.447284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.435927Z","title":"Distributed swarm trajectory optimization for formation flight in dense environments,","venue":null,"work_id":"c177b790-ff32-429c-aaf6-2e40ddd2d726","year":2022},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.321432Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:b0dc1bc5d43b3f46b8334c7873cae9cd2ac3c7791e061cc345a00a6c65286769","observation_id":"4a5e88e6-0b93-4744-aec7-b4eb4cfddfb2","resolution":{"observed_at":"2026-08-06T15:15:26.438654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-09T23:04:15.431743Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-06T15:15:26.323832Z","title":"High-dimensional continuous control using generalized advantage estimation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.323832Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:10fe8631bcca06203d76b5484f0bd27fc95329803f321e7546263550fd24d187","observation_id":"bc38e57e-663e-43b7-b7a8-b6ea90ba8722","resolution":{"observed_at":"2026-08-06T15:15:26.323832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.427903Z","title":"Asynchronous Methods for Deep Reinforcement Learning,","venue":null,"work_id":"6195e4de-2dbe-4010-9584-b473a57108cb","year":2016},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.326828Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:7ede22fa526e2956f68dd99e9a936a0efbb7493a8d73e457291768bfa0501510","observation_id":"512bfd60-7e1f-49f0-81dd-4ba8d691cecf","resolution":{"observed_at":"2026-08-06T15:15:26.430760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.419018Z","title":"Qwen2.5 Technical Report,","venue":null,"work_id":"43f4d1b6-3486-4ce9-8a9e-de06a83b7101","year":2024},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.329259Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:f1c9a8ca64acd08f58789f11776af2b06a2ffc0299a7c02bb92c5813bc6d2538","observation_id":"c19c8140-8183-4258-b2ea-62779837963c","resolution":{"observed_at":"2026-08-06T15:15:26.422025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:26.408243Z","title":"Decentralized non- communicating multiagent collision avoidance with deep reinforce- ment learning,","venue":null,"work_id":"f3999b1c-9b7f-4c04-ae07-21ee2c8f7bea","year":2017},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.331659Z"},"links":{"citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:202f8d6b0ceda91eee3197074afb20594c1e6d3387c6d50cede1564582366457","observation_id":"c9ea01f0-55d7-4287-acc1-29068e5ad278","resolution":{"observed_at":"2026-08-06T15:15:26.412821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01967","last_updated":"2024-06-04T04:53:05Z","snapshot_observed_at":"2026-08-06T02:17:45.601842Z","submitted_at":"2024-06-04T04:53:05Z","title":"DrEureka: Language Model Guided Sim-To-Real Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01967","snapshot_observed_at":"2026-08-06T15:15:26.334084Z","title":"Dreureka: Language model guided sim-to-real transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:26.334084Z"},"links":{"cited_paper":"/paper/2406.01967","citing_paper":"/paper/2507.16382"},"observation_digest":"sha256:3233b6c922946b3807f3a7c8dc01c5af71222d06770c3ed06926712fc5243b15","observation_id":"02c0bf11-842e-407d-a166-d4d3129d883d","resolution":{"observed_at":"2026-08-06T15:15:26.334084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.16382","last_updated":"2025-07-22T09:26:00Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T15:08:28.088291Z","submitted_at":"2025-07-22T09:26:00Z","title":"Application of LLM Guided Reinforcement Learning in Formation Control with Collision Avoidance"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.16382."}