{"as_of":"2026-08-19T14:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34efbf18958f2637304f86084320ffbca6c8b9305d84520f598fce60225a4116","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:01:08.418006Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18126/citation-record","integrity":"/paper/2506.18126/integrity","json":"/paper/2506.18126/citation-record.json","paper":"/paper/2506.18126"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.375064Z","title":"Meta reinforcement learning for strategic IoT deployments coverage in disaster-response UA V swarms,","venue":null,"work_id":"c73a0eba-ad3b-4317-b65c-061cf7a7e490","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.177897Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:52fff13e1a7da444591a55c8ff1e62fab5b6f46c8e75f22385a59d8898ed61a2","observation_id":"87d82415-cad8-4838-b39b-1ca6e7258991","resolution":{"observed_at":"2026-08-15T19:01:09.380241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.359018Z","title":"A distributed control framework for a team of unmanned aerial vehicles for dynamic wildfire tracking,","venue":null,"work_id":"da006d22-4cac-4e16-8936-95a46b4831fa","year":2017},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.184127Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:3101b5f11c113c911cd418798868626ed294744393419c9242e68a55c9f93299","observation_id":"21e8f11d-8194-40ec-9e3f-c51a27c18eb1","resolution":{"observed_at":"2026-08-15T19:01:09.365479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.339364Z","title":"Transfer reinforcement learning for multi-agent pursuit- evasion differential game with obstacles in a continuous environment,","venue":null,"work_id":"a77862fc-26ca-4ea4-ad91-6fd7a46a3f65","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.190255Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:83d9f875c314a52343e85615e2a39a339f54bfdea5e49567f5eab2dd5daf1ecc","observation_id":"29bb12f8-13a6-48f5-b6ce-0426e09b1ad5","resolution":{"observed_at":"2026-08-15T19:01:09.344356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.324786Z","title":"Consensus, cooperative learning, and flocking for multiagent predator avoidance,","venue":null,"work_id":"646bd670-c445-40f6-96fb-ae1e65fcf01c","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.196531Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:e69197caa92d362262708cca9f70e2f9b47cebda1ec955b224320fa4e0e050ad","observation_id":"3376e5cc-f667-46cd-9e79-c7ff5a89cd23","resolution":{"observed_at":"2026-08-15T19:01:09.329180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.311214Z","title":"Multi robot surveillance and planning in limited communication environments,","venue":null,"work_id":"ae4d4ea4-8b76-44f0-813b-3206347a2f4a","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.200751Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:187c3e299f319cdf0776c3b9844f938fe5ecbe2969a4e1682df38ccd1fd2de91","observation_id":"e62f8ab1-e538-4e44-b499-7ab9f0c7d3ce","resolution":{"observed_at":"2026-08-15T19:01:09.315962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.294075Z","title":"Decentralized function approximated Q-learning in multi-robot systems for predator avoidance,","venue":null,"work_id":"482a0ce8-b8f3-422d-9efa-6c89c163f2c4","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.205799Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:c4ff19d33ecf88a27e1d57ae0474e55f275ebaf1ff8afee33aa56cb7a0cbce84","observation_id":"5ac658bf-a9d3-482a-a959-cb1149bc3263","resolution":{"observed_at":"2026-08-15T19:01:09.298659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.279287Z","title":"A pursuit-evasion game on a real-city virtual simulation platform based on multi-agent reinforcement learning,","venue":null,"work_id":"4fd82b8c-e939-434c-a9b5-f9c16db928fb","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.210279Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:4a3ab9ce984b8199999c04a262a133ee2ccc95397c92c3c16a5f505e91a54674","observation_id":"6052cfd9-13c6-4a57-bcd0-83451da9b67f","resolution":{"observed_at":"2026-08-15T19:01:09.283542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.262288Z","title":"Multiagent formation control and dynamic obstacle avoidance based on deep reinforcement learning,","venue":null,"work_id":"27c6a3a0-052a-4f84-a328-dd3ecf15b0d7","year":2025},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.214842Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:5dffd92d0d79bab3dbfdc62b53e248e974c6fa4c8f3d2232e1380db339dc519d","observation_id":"f539e8dc-9f85-4654-857e-fae9907fafb3","resolution":{"observed_at":"2026-08-15T19:01:09.267389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.247459Z","title":"Multi-agent actor-critic for mixed cooperative- competitive environments,","venue":null,"work_id":"8a66406b-a473-4a59-afda-261a292ab727","year":2017},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.218976Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:8fcfbe188c83d76dca6c4be5e899609ff14ddbf95f19a1c98b94c7d8c695897a","observation_id":"e1ca6aef-a7b1-413c-a517-bc23ae4052ba","resolution":{"observed_at":"2026-08-15T19:01:09.252384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.231592Z","title":"Collision-avoiding flocking with multiple fixed-wing UA Vs in obstacle-cluttered environments: A task-specific curriculum- based MADRL approach,","venue":null,"work_id":"756b6517-0634-49e0-8971-0c0abbe82d9b","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.223350Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:44edbb4880c8d809b77cc930c548da6cdf08b28e00f1fa1f29f23e1a691240f3","observation_id":"e57dd751-9193-4a67-98a9-73137e8cef11","resolution":{"observed_at":"2026-08-15T19:01:09.236654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.216516Z","title":"NVIF: Neighboring variational information flow for cooperative large-scale multiagent reinforcement learning,","venue":null,"work_id":"cc4aef3c-2ea2-4ca2-bd2b-1f207791633f","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.227672Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:e71b21e841deea907a055a87dc9001cd255b71284c75a5ca060a2b4d134effb5","observation_id":"fe94b017-23b4-4c95-82bb-4d47e6da97b7","resolution":{"observed_at":"2026-08-15T19:01:09.221020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.199194Z","title":"Monotonic value function factorisation for deep multi- agent reinforcement learning,","venue":null,"work_id":"75a46e06-6818-4ed9-8c2d-5bc7bd0094ca","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.232506Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:82846411b3e542ba6fb39cae31e9c67d403569641315f7f4f911e94d4257d286","observation_id":"a510f6d9-c9f0-43d5-922d-6c5d30640ee3","resolution":{"observed_at":"2026-08-15T19:01:09.203542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.184576Z","title":"Efficient multi-agent communication via self-supervised information aggregation,","venue":null,"work_id":"9d5ab151-386c-4ef5-960e-ba3824fd6d9b","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.236384Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:5bbd2a40d50f0c8c4a0f614f62b810ed7438cc250c589176a7c29a1b26152f16","observation_id":"20724c0e-9312-422b-a297-c07c1e206966","resolution":{"observed_at":"2026-08-15T19:01:09.189033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.171919Z","title":"Maximum entropy heterogeneous-agent reinforcement learning,","venue":null,"work_id":"61d5f9e7-e8a9-4a8e-aed4-77bd1bd0cc5c","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.240490Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:eb833efeec7e7a1e0c2813285117f86d3596941342a58aae7b999ff1b6c52f3e","observation_id":"bf4bb3d3-463b-4649-88db-196804d46f2a","resolution":{"observed_at":"2026-08-15T19:01:09.176088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T19:01:08.244374Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.244374Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:0b003f62772cc03c5dad61fdd59d37d82a517f38faf335b6acfc984a7cd0bae5","observation_id":"e8bec119-69c5-4f43-8418-68fa9b42b0d9","resolution":{"observed_at":"2026-08-15T19:01:08.244374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.159236Z","title":"The surprising effectiveness of ppo in cooperative multi- agent games,","venue":null,"work_id":"54450fec-0d67-4d49-8bf7-8b7f6f8b8bd9","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.248296Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:f363bd13f24a55eec51f13229c416a2dcbe046351bba8cdb7e96fef6e1a0b9f8","observation_id":"f2018717-3295-4912-a332-7208f2822206","resolution":{"observed_at":"2026-08-15T19:01:09.163566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18495","last_updated":"2025-03-01T06:47:01Z","snapshot_observed_at":"2026-08-16T13:06:23.292630Z","submitted_at":"2024-10-24T07:31:59Z","title":"Multi-UAV Formation Control with Static and Dynamic Obstacle Avoidance via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18495","snapshot_observed_at":"2026-08-15T19:01:08.257061Z","title":"Multi-UA V behavior-based formation with static and dynamic obstacles avoidance via reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.257061Z"},"links":{"cited_paper":"/paper/2410.18495","citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:2f5c6ca60f6d9e56c5dc5278e8c3f4788010a1353ae456e1889c386cd44b42f6","observation_id":"e29a62f4-1892-470f-ab72-85290fa587b8","resolution":{"observed_at":"2026-08-15T19:01:08.257061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.145886Z","title":"Relative distributed formation and obstacle avoidance with multi-agent reinforcement learning,","venue":null,"work_id":"fb958d63-8497-4b83-890b-2acf465e3a14","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.263284Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:800499c6626574fe660391667b8d8f1b97b0378d77235bafc9c379bee77b3133","observation_id":"90f5a988-50ff-4dbf-8c15-246f00ecfc78","resolution":{"observed_at":"2026-08-15T19:01:09.149885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.133368Z","title":"Hierarchical and stable multiagent reinforcement learning for cooperative navigation control,","venue":null,"work_id":"76b471d4-9619-40fb-a2a0-44c5492cf34d","year":2021},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.267946Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:babf04797d6b5adbf4b5d51d2e73e2bde5e7b6979f6f43e4cae2744e7f2daf73","observation_id":"f73ccf7d-fc11-4b8f-8a4b-b0ddd428ea11","resolution":{"observed_at":"2026-08-15T19:01:09.137721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01423","last_updated":"2023-12-03T15:01:11Z","snapshot_observed_at":"2026-08-16T14:38:05.806409Z","submitted_at":"2023-12-03T15:01:11Z","title":"Self-Critical Alternate Learning based Semantic Broadcast Communication","version":1},"cited_work":{"arxiv_id":"2312.01423","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.01423","snapshot_observed_at":"2026-08-15T19:01:08.507347Z","title":"Self-Critical Alternate Learning based Semantic Broadcast Communication","venue":"eess.SP","work_id":"ee9b8c6f-f756-4514-b3de-189a770baf6f","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.271755Z"},"links":{"cited_paper":"/paper/2312.01423","citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:9c6df03a5c1d05248e99b28518ff34e97e9297ba581baa5ff5d6ad8ef2fd4a89","observation_id":"85b3805e-8781-4b44-b28f-e3de32c959a8","resolution":{"observed_at":"2026-08-15T19:01:08.511753Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.120326Z","title":"A survey of multi-agent deep reinforcement learning with communication,","venue":null,"work_id":"161bc05b-d3c0-4037-bac4-204676780eb1","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.276761Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:848db387cf0c954e36463c14157dc7f0432d81a68ec45077c35527dd844ac585","observation_id":"d3f6b8a9-70e7-4be3-a21e-fa2b26b50ee8","resolution":{"observed_at":"2026-08-15T19:01:09.125126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.107845Z","title":"Consensus in multi-agent systems: A review,","venue":null,"work_id":"f5281076-e4fb-4a84-83d3-8571489404aa","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.280582Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:e7e4a91a3210edb21743f1c87f6c54c65b6166ac8a6786c95058f04415596113","observation_id":"cd8006f4-bd86-41dd-9319-f8109aa0f979","resolution":{"observed_at":"2026-08-15T19:01:09.112088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.096246Z","title":"Data-based optimal consensus control for multiagent systems with policy gradient reinforcement learning,","venue":null,"work_id":"4274a7e5-e41b-409a-a60b-d4ce3274858e","year":2021},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.285477Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:f8dd5606ec108cf954297b0ec6221157d8683623eb6339463ca0325ffc7c2200","observation_id":"4ed41304-a024-4fed-bcd6-b817f0fce36d","resolution":{"observed_at":"2026-08-15T19:01:09.100463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.083673Z","title":"Learning multiagent communication with back- propagation,","venue":null,"work_id":"081f435d-ce27-4e6b-9fe7-3a9da2084c25","year":2016},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.289874Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:76a2835af82bc5578557d630718590e9d60c4cf9d12e4fb7510c91e58875474e","observation_id":"4062e643-f7fc-4b1d-9789-02d030673b4b","resolution":{"observed_at":"2026-08-15T19:01:09.087927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.064213Z","title":"TarMAC: Targeted multi-agent communication,","venue":null,"work_id":"47d13de2-d97e-4781-b509-6ff89313c01d","year":2019},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.294970Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:a3769ee52bf8ed5805af0660f6917a18142f966971bfbcdd8fd70c7554eca5ed","observation_id":"9ecefbdd-b7e2-4655-9f8a-8db14c289246","resolution":{"observed_at":"2026-08-15T19:01:09.068865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.049423Z","title":"Communication in multi-agent reinforcement learning: Intention sharing,","venue":null,"work_id":"253d27b9-5cce-42fc-aab5-25e0d6d10b44","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.298638Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:db6e852509d0f349a6594be8d8cb4c6aee338596b23d1f0ddea2db904c3a7819","observation_id":"a139f122-0872-4eca-80bb-f5c442624f8b","resolution":{"observed_at":"2026-08-15T19:01:09.053849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.034882Z","title":"ToM2C: Target-oriented multi-agent communication and cooperation with theory of mind,","venue":null,"work_id":"dce4fa45-5a7f-46e6-94b0-cd6c5049ef58","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.302822Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:46f89c81bb9957a0c89b92b32c85da72c1a965d6a993fd06d27e4e73b96795f0","observation_id":"98559a30-36c2-4fa1-b231-a9b29ff1bff0","resolution":{"observed_at":"2026-08-15T19:01:09.038923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.019019Z","title":"Consensus learning for cooperative multi-agent rein- forcement learning,","venue":null,"work_id":"7fb49267-658c-4aa4-bdc5-d511eaef2307","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.306569Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:58e6bf43778869561f52f91a53bf53bb94ab9f4cb9abc4832dd060884ba26ae5","observation_id":"83699ba6-599c-4379-b878-c639cad46e11","resolution":{"observed_at":"2026-08-15T19:01:09.024582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:09.004569Z","title":"Hierarchical reinforcement learning: A comprehensive survey,","venue":null,"work_id":"1fee886e-6dee-4b49-a04e-19d249195bf9","year":2021},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.310225Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:a83563ea773ae2645eba788da615b5ddb02bcf1d4c1f034cee795ec6ec32f1c7","observation_id":"33bb4d03-155e-4329-83e5-b81199b4fe66","resolution":{"observed_at":"2026-08-15T19:01:09.009993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.992601Z","title":"Ase: Large-scale reusable adversarial skill embed- dings for physically simulated characters,","venue":null,"work_id":"bea0c967-68bd-4061-83de-617dbec44fdd","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.314310Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:bb18f0ec74582ab68bedc43566c9e6ac3059848d2c55abc906313e5d80ecdafe","observation_id":"e5a09147-7440-49b1-89e8-9f03ea130c19","resolution":{"observed_at":"2026-08-15T19:01:08.996479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.980981Z","title":"Autonomous obstacle avoidance and target tracking of UA V based on deep reinforcement learning,","venue":null,"work_id":"2fcb5533-4e6f-4a61-a2e0-28c232a1ee55","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.318299Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:fd440be8e00143029049223e3a5317ae78be10978c304a53ee8f644d98923d01","observation_id":"73ab687a-bc50-4427-a8b3-68d5b9363761","resolution":{"observed_at":"2026-08-15T19:01:08.985014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.967837Z","title":"Game of drones: Multi-UA V pursuit-evasion game with online motion planning by deep reinforcement learning,","venue":null,"work_id":"d5c98bd6-af3c-4617-9877-e39d03749512","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.321999Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:a6e329193ca7a712cce8b0a04290b9e6f3b3034a62a16b40427ee03b70e0c4bc","observation_id":"7039541d-9dbf-4e0e-ac34-2a6c66ce0789","resolution":{"observed_at":"2026-08-15T19:01:08.972438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.951793Z","title":"Large scale pursuit-evasion under collision avoidance using deep reinforcement learning,","venue":null,"work_id":"613810e0-08f6-4f5f-9228-885d63d2f04b","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.325864Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:9efdd15a67d16efbf2e02abc62031916661703e742fd7b539288938cdf716fe2","observation_id":"1e53a3c3-6059-4422-a31d-778d7d4da0a1","resolution":{"observed_at":"2026-08-15T19:01:08.956071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.939096Z","title":"Multi-agent cooperative pursuit-defense strategy against one single attacker,","venue":null,"work_id":"46d55c23-d5c8-40c2-9226-a5ba3d0bf89f","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.329475Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:55bdfd0f95e34126a57afe22a636ce5f2c0d1711514e3b36ac4af58c67cdf984","observation_id":"eba45ea3-770d-4a67-af7b-2635046d0a24","resolution":{"observed_at":"2026-08-15T19:01:08.943992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.922241Z","title":"Feudal reinforcement learning,","venue":null,"work_id":"4cb79e3a-d72b-4f99-b41c-fe88b5d659c0","year":1992},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.333544Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:b8db8387f07a8aeabcdc81d77ad5412fd38dc8224719bc072eeb9cb6b4231b45","observation_id":"23e8865a-2b92-4d2f-9d20-669b615af558","resolution":{"observed_at":"2026-08-15T19:01:08.926628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.910082Z","title":"Hierarchical reinforcement learning with the maxq value function decomposition,","venue":null,"work_id":"24ff94a8-8e5c-4b2d-8f20-4df18f2f8a9a","year":2000},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.337176Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:0b3cff1fdc705c0a0388a2e1aa27935ffd1b17c3c1e0aa123990df82a0af5de4","observation_id":"64d907f0-2d3b-4b2b-abde-50359a16ab93","resolution":{"observed_at":"2026-08-15T19:01:08.914393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.764901Z","title":"The option-critic architecture,","venue":null,"work_id":"d4169873-5464-4270-8e2e-f58442611cdb","year":2017},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.340958Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:f10fbb37df78a0f8436f04c24bd1c08912d2e6a05829a9a0482b846e2f713433","observation_id":"24dbce73-3dd2-45cf-b026-99eac3547bf3","resolution":{"observed_at":"2026-08-15T19:01:08.769027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-08-17T01:47:25.235810Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-15T19:01:08.344501Z","title":"Learning multi-level hierarchies with hindsight,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.344501Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:eb2a5debd21a5bf5ee0da0e3aef314e30d56c7e0040e2cdacac806d09ce65c44","observation_id":"ca7df706-ce4c-4618-b77c-fca2932b4977","resolution":{"observed_at":"2026-08-15T19:01:08.344501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.752021Z","title":"Px4: A node-based multithreaded open source robotics framework for deeply embedded platforms,","venue":null,"work_id":"bf0a4611-4846-4d4c-85e0-a67d75d40e04","year":2015},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.348465Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:d95691b25bbbdf36b867863a81e1c65f5e57cabdcde3a566847af8aeddb1b1ad","observation_id":"96427d84-5751-427b-ad4e-18a978adb133","resolution":{"observed_at":"2026-08-15T19:01:08.755825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.739234Z","title":"Modelling, identification and control of a quadrotor helicopter,","venue":null,"work_id":"620cdcd8-ddfa-48f4-9c58-46cd52a40ef6","year":2008},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.352225Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:2fa05078662d1ae2a3bc2f6d6e98759f09058829831f6a5e44f936158a9ed04c","observation_id":"32ce956b-4409-4ebd-88a9-610ffd6741d8","resolution":{"observed_at":"2026-08-15T19:01:08.743568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.725499Z","title":"Long-term tracking of evasive urban target based on intention inference and deep reinforcement learning,","venue":null,"work_id":"255ce161-fa85-41aa-aa95-6feb7909908b","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.356068Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:85e8c6afaeffd64269b2b5c96a7acda40a2e27fc24a79f8ee59cc7d8d4c5b464","observation_id":"c4b4d9fb-a4b4-405d-bfd2-02c591ca9000","resolution":{"observed_at":"2026-08-15T19:01:08.729880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.712896Z","title":"Flexible formation control using hausdorff distance: A multi-agent reinforcement learning approach,","venue":null,"work_id":"bf16fe90-0f27-48d9-925c-896888f448f0","year":2022},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.359622Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:8a7ea7044eac6359ec7f8ef3ce30b1b8fc38f3fd439298e8f9979d4394b799cc","observation_id":"14dd53f6-3279-47b1-9963-9754e3c1f698","resolution":{"observed_at":"2026-08-15T19:01:08.717072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.700694Z","title":"High-dimensional continuous control using gen- eralized advantage estimation,","venue":null,"work_id":"e091c647-04e1-4f7c-8767-cfc5961767bd","year":2016},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.364318Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:06fb05ca57d91a6031dfc89e97dc90462f349c4f51f5f943609919fbe0ae09a0","observation_id":"c91afaa3-ef18-44d9-8c3e-8d7e610c4528","resolution":{"observed_at":"2026-08-15T19:01:08.704986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.688514Z","title":"Policy distillation,","venue":null,"work_id":"a9b7818c-6abe-46ca-9871-3ec8e71a5d5f","year":2016},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.368112Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:7131ae55ace93dfb6a9ac2ecf1d98d3b702090f3a791a8ee2806e9344916d266","observation_id":"facc8826-b98c-4104-8568-e5b32d2c381a","resolution":{"observed_at":"2026-08-15T19:01:08.692360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.676500Z","title":"Attention is all you need,","venue":null,"work_id":"1ba2d357-216f-4c6d-b47a-6a82fea83f9a","year":2017},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.372174Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:4db11df8a1fb556be8a114488db7bad441844af177a4cc04d42acc4f2536fc4f","observation_id":"88149d4d-37be-40b1-b28c-0d3d202760c6","resolution":{"observed_at":"2026-08-15T19:01:08.680471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.664008Z","title":"Design and use paradigms for gazebo, an open-source multi-robot simulator,","venue":null,"work_id":"9e916c91-222b-41e1-b0d9-a05808c83589","year":2004},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.375849Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:3bb3713ba87ec59a74f3ff9329be0015a697b80ede62aaf1861b0eb4c51116f0","observation_id":"4c528a61-7662-4287-a5f5-f88870fa00ae","resolution":{"observed_at":"2026-08-15T19:01:08.668318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.651997Z","title":"Recent progress on 3gpp 5g positioning,","venue":null,"work_id":"8868cd9a-64ef-46fd-8eea-891a27ad8191","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.379547Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:37d851dc2e4de2fa4e3e4fcb6c7142f109c82f744cf456f13712bd73ee681c8b","observation_id":"8f00d8bd-9690-481d-9d37-20c3c8bcf040","resolution":{"observed_at":"2026-08-15T19:01:08.656046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06329","last_updated":"2023-10-10T05:54:04Z","snapshot_observed_at":"2026-08-16T14:53:35.121975Z","submitted_at":"2023-10-10T05:54:04Z","title":"Precise Payload Delivery via Unmanned Aerial Vehicles: An Approach Using Object Detection Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06329","snapshot_observed_at":"2026-08-15T19:01:08.383189Z","title":"Precise payload delivery via unmanned aerial vehicles: An approach using object detection algorithms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.383189Z"},"links":{"cited_paper":"/paper/2310.06329","citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:ea7dba691c86425a68a33add64a2a81e6f68ab501dc1550a49f5ed1d847e0710","observation_id":"83523243-86f7-4116-9d9c-eaafd791e943","resolution":{"observed_at":"2026-08-15T19:01:08.383189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.636599Z","title":"Formation control with collision avoidance through deep reinforcement learning using model-guided demonstration,","venue":null,"work_id":"e5745077-ec24-4c20-9728-08a9bb19a33c","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.387873Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:8b32420ceaa131c0f07fdd1456279ca46bcf60edc1eb801552124951aa54719a","observation_id":"8cd2cc43-6a98-4c62-9a65-4db2212a7792","resolution":{"observed_at":"2026-08-15T19:01:08.642607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.620011Z","title":"Xtdrone: A customizable multi-rotor UA Vs simulation platform,","venue":null,"work_id":"4e22a549-8c30-44da-83df-25ba41518d2d","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.391899Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:95ab4cb1059faa10256484ead3354173ca6cb76700dd395f8978f94ae6191f7e","observation_id":"7434332f-29fc-4f6a-8c8a-aac7bf72bfca","resolution":{"observed_at":"2026-08-15T19:01:08.624638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.603766Z","title":"Efficient and scalable reinforcement learning for large- scale network control,","venue":null,"work_id":"33c82177-e33e-47d8-8749-1642e1c8811d","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.396557Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:cc9d2d6f7040e495acc2a60c22a14f90b1d5790c617baa147d86a2bfff7a47da","observation_id":"7890b44e-ef28-43e8-90fc-bf055346fd9f","resolution":{"observed_at":"2026-08-15T19:01:08.609052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.589903Z","title":"An attention mechanism and adaptive accuracy triple- dependent maddpg formation control method for hybrid uavs,","venue":null,"work_id":"78ca37da-0fe5-49e2-867c-78d86be3486a","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.400658Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:20f6006a0d20e291eb60a4e5e8ff59477336bfda6185105914f2ca0842370338","observation_id":"603369eb-6e78-41f2-a0b6-83101db23758","resolution":{"observed_at":"2026-08-15T19:01:08.594648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00420","last_updated":"2026-06-09T13:25:29Z","snapshot_observed_at":"2026-08-16T14:13:48.563749Z","submitted_at":"2024-03-01T10:16:46Z","title":"Robust Deep Reinforcement Learning Through Adversarial Attacks and Training : A Survey","version":3},"cited_work":{"arxiv_id":"2403.00420","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.00420","snapshot_observed_at":"2026-08-15T19:01:08.455480Z","title":"Robust Deep Reinforcement Learning Through Adversarial Attacks and Training : A Survey","venue":"cs.LG","work_id":"d7e617d5-70ce-4261-a52b-2ae1b9fd0bdf","year":2024},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.404951Z"},"links":{"cited_paper":"/paper/2403.00420","citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:6793d3d10bf1a0f2f54e0fa2f600e3f141581b7b498a507f23a0796f612eebf2","observation_id":"8a92039a-e59f-4f6b-9db3-f36e5f07bcd1","resolution":{"observed_at":"2026-08-15T19:01:08.462969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.576353Z","title":"Robust multi-agent coordination via evolutionary generation of auxiliary adversarial attackers,","venue":null,"work_id":"049c5073-33c8-4f68-8fab-c486804c903c","year":2023},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.409444Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:3f216c9b7f311da4998ca858dfb0190cb954beede0dd85c34bf2ad1022111f4b","observation_id":"3e315198-bfdb-44ac-ae59-03d828968a01","resolution":{"observed_at":"2026-08-15T19:01:08.580847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.563455Z","title":"Policy gradient methods for reinforcement learning with function approximation,","venue":null,"work_id":"d3f64ec2-5f90-4e6e-bb0d-44181d1aa46b","year":1999},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.413855Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:99ef3b6ed7dc0a069828602e95537f64bbdde4079d39ca97f4537cada5ec97dd","observation_id":"b13e96ac-9e39-4424-85bb-113355e253b9","resolution":{"observed_at":"2026-08-15T19:01:08.567655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:01:08.550618Z","title":"Learning to utilize shaping rewards: A new approach of reward shaping,","venue":null,"work_id":"c43dbd15-170a-42bb-9466-24286dede7c6","year":2020},"citing_paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T19:01:08.418006Z"},"links":{"citing_paper":"/paper/2506.18126"},"observation_digest":"sha256:9a1e9351ae6ceba4858c8372735a081013e60714a450dfd8d106b698830a1d20","observation_id":"fde98ebc-5428-4e2f-8d3e-f2f03f23224c","resolution":{"observed_at":"2026-08-15T19:01:08.554628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.18126","last_updated":"2025-06-22T18:23:58Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T22:02:39.391150Z","submitted_at":"2025-06-22T18:23:58Z","title":"Decentralized Consensus Inference-based Hierarchical Reinforcement Learning for Multi-Constrained UAV Pursuit-Evasion Game"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":2,"verified_fuzzy":50},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2506.18126."}