{"as_of":"2026-08-08T06:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71c8e6dca26b62cf056edaae68601d80981f35c95f6a7b08216eff484da426a1","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:43.089424Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14209/citation-record","integrity":"/paper/2505.14209/integrity","json":"/paper/2505.14209/citation-record.json","paper":"/paper/2505.14209"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:51.381516Z","title":"A review of multi-agent perimeter defense games,","venue":null,"work_id":"65f44abc-59ab-4254-a5c4-e5f7c4b22a18","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.089250Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:f28777b84700c99ededc506569c66645f700abd1c392822bf80ac7c754d5e82e","observation_id":"65c8b065-a85e-47ef-b361-1eab9e2c38ec","resolution":{"observed_at":"2026-08-07T15:42:51.485434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:51.183201Z","title":"Local-game decomposition for multiplayer perimeter-defense problem,","venue":null,"work_id":"29e295cc-e465-43cd-b6d9-4e5593dfb07a","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.153700Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:566b59bc352ff7d95e626efade8c9783b7d1cf28532ea90528a988ba4ed6df89","observation_id":"c4f3cc1e-94f7-441c-97bc-b7f3f4597187","resolution":{"observed_at":"2026-08-07T15:42:51.248454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.990358Z","title":"Modeling of target tracking system for homing missiles and air defense systems,","venue":null,"work_id":"cde00125-fd5d-45ec-9489-3f1009898469","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.260792Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:365d278a669842c4e290d78ba93989b8f74ec71e503a36015fa93cc7b93689a7","observation_id":"fa26c9d4-ef36-4ba6-ba65-b9fb0be63621","resolution":{"observed_at":"2026-08-07T15:42:51.077899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.741957Z","title":"Simulation of intelligent unmanned aerial vehicle (UA V) for military surveillance,","venue":null,"work_id":"f98e9486-42c1-4501-989d-98ef0abbdc75","year":2013},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.370065Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:0fd8d499dabc6536d7c806d89b6619100aa8253a11bd553e28d530f315e7de2b","observation_id":"c936c982-f38b-41d7-9c21-454a17f37d97","resolution":{"observed_at":"2026-08-07T15:42:50.873793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.620431Z","title":"A hierarchical deep reinforcement learning framework for 6-DOF UCA V air-to-air combat,","venue":null,"work_id":"0aff6d09-9221-4f1a-91f9-c64b2db0db1d","year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.456607Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:e8adc0c8015a4179c4000ddf9db74cd93698c9494b679412d74728b6c8c97971","observation_id":"5e3fc813-6565-4816-985c-6b53e6e1b204","resolution":{"observed_at":"2026-08-07T15:42:50.695571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.446642Z","title":null,"venue":null,"work_id":"7cd5651d-0273-4a42-b51c-e3ae2318e076","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.535022Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:2211083f98ad51a18190233006c9e7d301ebf369e7f4b64825e24bc203868786","observation_id":"379d3435-9bb1-42f4-a5da-fcd0ed85f181","resolution":{"observed_at":"2026-08-07T15:42:50.474913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.229347Z","title":"Competitive perimeter defense on a line,","venue":null,"work_id":"bebf7e8d-41a8-4ace-89a5-95cfd6f12daf","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.658738Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:8d34a69ee4ff4f7f7cf8248b08f076d53acbe03677252ce15e9df8551a61ec38","observation_id":"27fbd88d-1b71-4f12-a266-c61365f76bb3","resolution":{"observed_at":"2026-08-07T15:42:50.313945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.056041Z","title":"Team composition for perimeter defense with patrollers and defenders,","venue":null,"work_id":"b48cf50d-33e1-456c-9c6d-88fb085dd83c","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.757099Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:4a9aa55b625f6512d6b709a1667656496422e4abe217de32fe86d23f0ead9999","observation_id":"fcc9c6d1-6b0c-492b-b6a4-509d87dc53d1","resolution":{"observed_at":"2026-08-07T15:42:50.185536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.780108Z","title":"Cooperative team strategies for multi-player perimeter-defense games,","venue":null,"work_id":"5dd9cccc-d36a-4070-8286-915b508edfe1","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.828945Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:8e01a0961a0d02099ec864a8b19134f5df1a8d42d6558fe9610c7cd8ae1c5bde","observation_id":"324a1788-5e9d-4905-910d-5038cbf905d9","resolution":{"observed_at":"2026-08-07T15:42:49.902523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03989","last_updated":"2021-05-01T04:20:32Z","snapshot_observed_at":"2026-08-06T16:35:45.702720Z","submitted_at":"2019-09-09T16:58:56Z","title":"Perimeter-defense Game on Arbitrary Convex Shapes","version":3},"cited_work":{"arxiv_id":"1909.03989","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.03989","snapshot_observed_at":"2026-08-07T15:42:43.888733Z","title":"Perimeter-defense Game on Arbitrary Convex Shapes","venue":"eess.SY","work_id":"c9b9c27b-0e0c-434b-89be-98d06c5b3297","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.935733Z"},"links":{"cited_paper":"/paper/1909.03989","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:95f0e66760c70b8991ec5dc970d4771ad331d2bc0e593962462265fc75201678","observation_id":"56ba129d-8a6c-4bf3-acaf-aed8e4d3be83","resolution":{"observed_at":"2026-08-07T15:42:43.929369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.666589Z","title":"Multivehicle perimeter defense in conical environments,","venue":null,"work_id":"2ae7d691-fb76-4aed-b02d-e4b1997dede0","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.996933Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:5501e95be82379c90253039d03143e9510cc675c46f703bd8c8afd78f9a5f944","observation_id":"05b0481a-b4a2-4c99-949c-d298fa63ecf3","resolution":{"observed_at":"2026-08-07T15:42:49.718911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.465353Z","title":"Perimeter-defense game between aerial defender and ground intruder,","venue":null,"work_id":"6644f83c-716f-48b3-8606-1a2ff110f131","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.085886Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:b91287a5399f4d97314af42dbf55b4bdbae7858672944dcf96573c9f80ac99e9","observation_id":"17863a73-ca1d-4a16-b2a8-60180e8cb232","resolution":{"observed_at":"2026-08-07T15:42:49.560139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.308792Z","title":"Defending a perimeter from a ground intruder using an aerial defender: Theory and practice,","venue":null,"work_id":"3d55758d-7ede-4ff4-8d0f-441f61bb7abb","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.211142Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:c1d39ad6ced0680969975bbee4571b57f655a772f8511ee559fd915d1f9c093b","observation_id":"4ae7e59d-1413-43d9-99d5-b5c0d91c514e","resolution":{"observed_at":"2026-08-07T15:42:49.390587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01757","last_updated":"2022-09-24T22:48:51Z","snapshot_observed_at":"2026-08-05T07:55:57.101722Z","submitted_at":"2022-09-24T22:48:51Z","title":"Learning Decentralized Strategies for a Perimeter Defense Game with Graph Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01757","snapshot_observed_at":"2026-08-07T15:42:39.298718Z","title":"Learning decentralized strategies for a perimeter defense game with graph neural networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.298718Z"},"links":{"cited_paper":"/paper/2211.01757","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:3d59da20072cbd0e926f7548044f031870c769ba81ec6ae4ae580e59e48611dc","observation_id":"b018a4b0-ec6a-4571-a27e-469d6fa13937","resolution":{"observed_at":"2026-08-07T15:42:39.298718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12136","last_updated":"2022-09-25T03:41:45Z","snapshot_observed_at":"2026-08-06T05:50:26.092516Z","submitted_at":"2022-09-25T03:41:45Z","title":"Vision-based Perimeter Defense via Multiview Pose Estimation","version":1},"cited_work":{"arxiv_id":"2209.12136","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.12136","snapshot_observed_at":"2026-08-07T15:42:43.736564Z","title":"Vision-based Perimeter Defense via Multiview Pose Estimation","venue":"cs.CV","work_id":"6d13b889-5b66-41d2-9e4d-0386bdd4dbef","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.388461Z"},"links":{"cited_paper":"/paper/2209.12136","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:80b2d29d6d5ab28d075d4695affe5d3bb729197280b189ac803e2d3448d8f7c5","observation_id":"312c2a04-06eb-41d2-893f-e1f11cfbf1c5","resolution":{"observed_at":"2026-08-07T15:42:43.788711Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.147947Z","title":"The role of heterogeneity in autonomous perimeter defense problems,","venue":null,"work_id":"36eeb4bd-9753-4227-9b8c-91b1111783c6","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.473745Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:915264d15112af80e4b1159299a470b0dc3bc6709e69df76a60408af333f83fc","observation_id":"a8d80f7f-51d0-40be-a679-11380716a7e4","resolution":{"observed_at":"2026-08-07T15:42:49.225002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.963287Z","title":"Intercept angle missile guidance under time vary- ing acceleration bounds,","venue":null,"work_id":"ff402db7-8a99-4ed3-afc0-8b8cfb2ab102","year":2013},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.577566Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:c8a3d653eed9e67436178b3d707e68979c2415d1a21fe9f1b319cf324bfe938d","observation_id":"58c816ab-d90a-473e-b3fd-b6b1b53401e5","resolution":{"observed_at":"2026-08-07T15:42:49.054132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.748757Z","title":"The effects of different wing configurations on missile aerodynamics,","venue":null,"work_id":"9e8ea0bd-4076-432c-adab-1a8b303aa5d9","year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.677375Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:2856cf409f7db79b2ad58a1742a9579d8e9f996ccc1f219e7bbb1d9e9e5b24ef","observation_id":"256f5199-5ffc-4291-854c-a9e0c8da7102","resolution":{"observed_at":"2026-08-07T15:42:48.818595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.596876Z","title":"Dynamic Modeling, Guidance, and Control of Missiles,","venue":null,"work_id":"9024d596-8b58-4d45-b65b-db82eee39ef7","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.769059Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:13edff4d95a2b2e3fffa9fee89535f8ced848d20b0bf335bf8b20c4116ffded3","observation_id":"7e93d0f3-3bc3-4c03-9456-843af168c59d","resolution":{"observed_at":"2026-08-07T15:42:48.674741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.335876Z","title":"Nonlinear Autopilot for Improving Guidance Performance of Dual-controlled Missiles With Lateral Thrust Regulation,","venue":null,"work_id":"d396ea10-5fb9-4cf6-8f6a-d9de2327ad19","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.858799Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:879356ea1bf30e58c02382a5118e03c2e6cb27c9bcffeab701a61e2637dad7c3","observation_id":"8311fe39-57fa-4673-9453-f8711b8e3172","resolution":{"observed_at":"2026-08-07T15:42:48.423402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.099383Z","title":"Wind compensation framework for unpowered aircraft using online waypoint correction,","venue":null,"work_id":"649e3271-7a3e-4506-ab58-96f6025f6341","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.969334Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:6a7cb69378bf50abc7338ad33285033539571167ea2275e08fe6db4f4d7c45c6","observation_id":"a50164ba-0f11-41e0-9a38-227bd6b50a5f","resolution":{"observed_at":"2026-08-07T15:42:48.215889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.910640Z","title":"Attitude control in ascent phase of missile considering actuator non-linearity and wind disturbance,","venue":null,"work_id":"0e186f91-43ee-485c-84ba-bd3bb812f2dc","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.033268Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:e7337ac4cf430a140a1787e5e6a941cad5d50234531191cec35afef028397e0e","observation_id":"520d503d-b98b-489c-a18a-c3f8e79e196f","resolution":{"observed_at":"2026-08-07T15:42:47.976040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.692807Z","title":"Safe multi-agent reinforcement learning for multi-robot control,","venue":null,"work_id":"d972a391-7bd7-4464-aeb2-9236da55ef38","year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.128968Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:ee5812ae90c96ef7e2769828b78f2be1561b23be3d6eb8ef2aa2ad3a85d44f54","observation_id":"29b6f66e-9ec6-456a-b64e-96871d3824b5","resolution":{"observed_at":"2026-08-07T15:42:47.794218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.358308Z","title":"Deep reinforcement learning for autonomous driving: A survey,","venue":null,"work_id":"e94d0065-6242-40a7-8657-7171738563b0","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.188906Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:e13722a88e46a044b9ed4728bfed61bf75f24448fb9b7a267c76ffabc6af4333","observation_id":"6135d2c2-d6fe-40b0-97d1-dfeba5c7e7ca","resolution":{"observed_at":"2026-08-07T15:42:47.508583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.197436Z","title":"Cooperative control for multi-player pursuit-evasion games with reinforcement learning,","venue":null,"work_id":"941d4d16-b785-4da8-b12a-6177a4d6e0eb","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.246739Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:872754359cc43b574fbb069e04f6cdfcc423f92959458744b5e74c7b7e4ae4ab","observation_id":"10c61f30-828e-42a7-8910-6485512d4f5a","resolution":{"observed_at":"2026-08-07T15:42:47.272327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.095998Z","title":"An approach to multi-agent pursuit evasion games using reinforcement learning,","venue":null,"work_id":"3885b0ec-2285-4b6e-839c-9746f0122ffe","year":2015},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.348726Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:40301a97973afe720688955f7706464c47449ebb67cc3749527fb5d93deca370","observation_id":"e67381ad-a566-489a-847b-f2b864d3b10c","resolution":{"observed_at":"2026-08-07T15:42:47.146654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.918662Z","title":"Game of drones: Multi-UA V pursuit-evasion game with online motion planning by deep reinforcement learning,","venue":null,"work_id":"1d8c440b-6409-481a-be2d-4eed65441c2d","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.434474Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:7ec43ac687ea4e321043b6d7c3fd59200e1c15125e85c3ecb43ea49835a33d15","observation_id":"a5364b30-a2ac-4243-a5b8-9ac7ebc4ec71","resolution":{"observed_at":"2026-08-07T15:42:47.013373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.732835Z","title":"Maximum Entropy Heterogeneous-Agent Reinforcement Learning,","venue":null,"work_id":"b5e0c4f0-fa20-40d0-a698-105ddd752051","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.535742Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:7039609e99de39327ebe96f2f29dcb0a63cd8f7efd4f385237d424f4bf9ba707","observation_id":"710c10ea-224c-4660-b95e-4577a399ed4c","resolution":{"observed_at":"2026-08-07T15:42:46.821175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.553132Z","title":"Heterogeneous-Agent Reinforcement Learning,","venue":null,"work_id":"f511872b-34be-496e-971d-fbfa7bf0bd36","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.657830Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:faa77c8ce3471668da411d8234666755238c4c007266f78bc95f4c948e2b9c5a","observation_id":"7547ce98-5989-403d-b972-0fe3dd10ee7d","resolution":{"observed_at":"2026-08-07T15:42:46.657243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.390497Z","title":"Mean field multi-agent reinforcement learning,","venue":null,"work_id":"202f11ba-ca32-4cd4-8cee-e89286ea263c","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.759302Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:0a64c29335c4d0091ad8157d15e538ac46e0249f5d7de33a4ae353e791fa2073","observation_id":"c61f88cb-45c9-4b7e-aa09-88fb133624ab","resolution":{"observed_at":"2026-08-07T15:42:46.461921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.224588Z","title":"Age of information minimization using multi-agent UA Vs based on AI-enhanced mean field resource allocation,","venue":null,"work_id":"ec408d6b-983f-4618-a3bb-4264556e2cde","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.864615Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:eb23e09e3fbe95732434a9059ee774e0cd5f371739495000e8ab48f53b938a5d","observation_id":"12a531f5-9329-45ee-b401-99861dc44209","resolution":{"observed_at":"2026-08-07T15:42:46.284738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.996189Z","title":"Joint Resource Allocation for V2X Communications With Multi-Type Mean-Field Reinforcement Learning,","venue":null,"work_id":"d78d2bc0-7589-4194-87ce-79e4c6763956","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.970120Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:3e8225162c5f1be0fef0e0d4885c8fb5412e100d7b78231195097c60163c2e74","observation_id":"bdce975b-b2a2-4c57-a50b-99b896aae4e9","resolution":{"observed_at":"2026-08-07T15:42:46.114954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.30082","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.559354Z","title":"Mean Field Deep Reinforcement Learning for Fair and Efficient UA V Control,","venue":null,"work_id":"0c2fc8c6-cf4b-4f1a-80d2-c2346790b818","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.077375Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:c0478f862ad1d188087af57890b4fc943c6fea0325854d0ce8e8cd052c1ef4e9","observation_id":"0afa7f07-8595-4382-8b48-767c432eff80","resolution":{"observed_at":"2026-08-07T15:42:43.616797Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.02513","last_updated":"2022-06-21T08:40:51Z","snapshot_observed_at":"2026-08-08T04:52:49.293651Z","submitted_at":"2020-02-06T20:58:58Z","title":"Multi Type Mean Field Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.02513","snapshot_observed_at":"2026-08-07T15:42:41.184986Z","title":"Multi type mean field reinforcement learning,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.184986Z"},"links":{"cited_paper":"/paper/2002.02513","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:85d788ea5106bbfd13f7670a5ca6b9c30df60af0ab8cf1970706527c4c0506bc","observation_id":"dee4f7b5-5477-482f-a1f8-33c7f32a061e","resolution":{"observed_at":"2026-08-07T15:42:41.184986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.761102Z","title":"Hierarchical mean-field deep reinforcement learning for large- scale multiagent systems,","venue":null,"work_id":"10eb66ab-4a20-4210-875b-9ccfaad936b6","year":null},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.261386Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:52c58d263158c8ac3b669c6bdf8e61fc2705caae489eaac1acb682f8f49f227e","observation_id":"38bc597a-1abb-4b0f-a0f6-ced8a82370af","resolution":{"observed_at":"2026-08-07T15:42:45.922723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.545524Z","title":"Weighted mean-field multi-agent reinforcement learning via reward attribution decomposition,","venue":null,"work_id":"8314e79b-53f3-4f68-9d8e-39696675bdfb","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.382634Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:9a7fca907da1070a56d1563a113ce23a05fe2aaf84ac643445bc7c4a1c61dc5a","observation_id":"6f150726-7e75-4fc8-a18b-420724056de4","resolution":{"observed_at":"2026-08-07T15:42:45.672117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.337688Z","title":"Attention Is All You Need,","venue":null,"work_id":"d1a7a9da-86ca-473f-b982-0ec5c4960266","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.486585Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:838eb7c3fab09869aad5845336d1395c647d674f2c0d88bda53163800ea5631f","observation_id":"036df322-0de1-497a-bcae-144972e55f63","resolution":{"observed_at":"2026-08-07T15:42:45.444065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14226","last_updated":"2024-05-01T13:00:39Z","snapshot_observed_at":"2026-07-06T13:46:52.990082Z","submitted_at":"2022-08-27T09:38:56Z","title":"Unsupervised Representation Learning in Deep Reinforcement Learning: A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.14226","snapshot_observed_at":"2026-08-07T15:42:41.674213Z","title":"Unsupervised representation learning in deep rein- forcement learning: A review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.674213Z"},"links":{"cited_paper":"/paper/2208.14226","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:6ba306ab58c0eb353618d4fd85c02217e84375810333746335535acedde86d74","observation_id":"5e413bd5-7749-47ff-be18-b0a785b446e2","resolution":{"observed_at":"2026-08-07T15:42:41.674213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.170572Z","title":"Fraccaro, S","venue":null,"work_id":"b58f2e0f-516c-4326-b22d-92eda4fe15dd","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.807648Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:a8efd5f9bce53b7d5e4774e2a76d4d830c9fe2c832ff5c866a33f5de344fb182","observation_id":"1207fbde-401b-4161-b3c6-8aa73c267d56","resolution":{"observed_at":"2026-08-07T15:42:45.225758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.999417Z","title":"Ha and J","venue":null,"work_id":"4c6e8048-c984-43dd-84d9-f34c9a11e640","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.877045Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:cc12e6cef4974d21e130c53189b8e1dba60377c6527ff4d1956dfd39d6ebabcc","observation_id":"7f3d9612-0999-4416-b083-1f582aa50176","resolution":{"observed_at":"2026-08-07T15:42:45.046871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-07T15:42:41.944567Z","title":"Ha and J","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.944567Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:8775ebe94f28c8f0f7d5c4b4ecf961694d81b8c4eef4f23e1571da3d4643851a","observation_id":"ae5c331c-da92-4ead-86a5-b41221d49ccd","resolution":{"observed_at":"2026-08-07T15:42:41.944567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.11963","last_updated":"2020-02-27T08:29:10Z","snapshot_observed_at":"2026-08-08T06:19:38.136041Z","submitted_at":"2020-02-27T08:29:10Z","title":"Plannable Approximations to MDP Homomorphisms: Equivariance under Actions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.11963","snapshot_observed_at":"2026-08-07T15:42:42.026878Z","title":"Van der Pol, T","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.026878Z"},"links":{"cited_paper":"/paper/2002.11963","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:29ba820e6a0e1427ff555168fe955df98ab155e6af014ca8a959cef3a716e7ed","observation_id":"9e21d576-90cf-466f-965b-7036f8dde1f2","resolution":{"observed_at":"2026-08-07T15:42:42.026878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.07679","last_updated":"2016-04-04T11:27:36Z","snapshot_observed_at":"2026-08-03T08:37:56.722087Z","submitted_at":"2015-12-24T01:31:40Z","title":"Deep Reinforcement Learning in Large Discrete Action Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.07679","snapshot_observed_at":"2026-08-07T15:42:42.109923Z","title":"Dulac-Arnold et al.,Deep reinforcement learning in large discrete action spaces","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.109923Z"},"links":{"cited_paper":"/paper/1512.07679","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:fec4ab3d80a610b04bf1e8d5f954a14216af1a922c7ea0a00a342b0f4b91642c","observation_id":"b26677a0-cb7a-4c76-9349-7035b64c0361","resolution":{"observed_at":"2026-08-07T15:42:42.109923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02006","last_updated":"2023-06-03T05:32:19Z","snapshot_observed_at":"2026-08-03T12:10:44.616924Z","submitted_at":"2023-06-03T05:32:19Z","title":"MA2CL:Masked Attentive Contrastive Learning for Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02006","snapshot_observed_at":"2026-08-07T15:42:42.213768Z","title":"MA2CL: Masked Attentive Contrastive Learning for Multi-Agent Reinforcement Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.213768Z"},"links":{"cited_paper":"/paper/2306.02006","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:2eadc53e2bf6da691e48fe81c8c7454a8f15f70520fd75ff5fdf4f6ec156db77","observation_id":"b2926790-48f9-448a-8686-a10be5b23d0c","resolution":{"observed_at":"2026-08-07T15:42:42.213768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.811368Z","title":"Learning action representations for reinforcement learning,","venue":null,"work_id":"84a6c993-6f5b-4938-b7c9-3f068adb21bc","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.318289Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:9fc468c92bceb3b2ca1e197b21257624272fc976fe1d11c47369615ca2ab8db3","observation_id":"8a638511-1288-41c9-8a87-59ef9655ccc4","resolution":{"observed_at":"2026-08-07T15:42:44.916663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.669961Z","title":"The Hungarian method for the assignment problem,","venue":null,"work_id":"6e389e5c-4f91-47b0-8358-5e60f2a37e8b","year":1955},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.407479Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:f4438b315d76525c740d9e43f4b319d440c8b1039883ee8ec797578f20f0c7bb","observation_id":"9ac4c81d-f50c-45c2-aae7-2f93d65379a9","resolution":{"observed_at":"2026-08-07T15:42:44.721298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.27033","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.281259Z","title":null,"venue":null,"work_id":"58afa798-6ac4-4563-b994-ff3bd28b7624","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.505143Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:8edb75099c8c6e62e6ef4ead53bc1330d8ff934a510003ddd8c3a2a9842770b8","observation_id":"69449878-9d92-4fc5-bf49-784d27c3f492","resolution":{"observed_at":"2026-08-07T15:42:43.341686Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.587925Z","title":"Robust estimation of a location parameter,","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.587925Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:c05b3100443496cea3ef1b7bfb016776301b7490a3f306dad1a9008f5f6d72ce","observation_id":"13d15a98-7054-4a45-a24a-ecf168993048","resolution":{"observed_at":"2026-08-07T15:42:42.587925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-07T15:42:42.682393Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.682393Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:0e06e359d9349d32a584820e353d58b2b3ad0c49f2c4ad022e3961c00f337909","observation_id":"c0e6bd86-c020-4fe6-864a-bf25a73feff5","resolution":{"observed_at":"2026-08-07T15:42:42.682393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.521314Z","title":"Addressing function approxima- tion error in actor-critic methods,","venue":null,"work_id":"a3188aaa-1166-4ccc-9638-577f7fd0aaba","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.770074Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:461b1fcb325e0b7301b8eaf5960695cf47d84ffbddb2f1ff96b34740faaffd20","observation_id":"e8720438-3187-4770-8331-15ad22b8bb0f","resolution":{"observed_at":"2026-08-07T15:42:44.590441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.366541Z","title":"Multi-agent actor-critic for mixed cooperative-competitive envi- ronments,","venue":null,"work_id":"86b2118a-235b-450a-80f5-71aac73b846e","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.844272Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:5d2b7dff5d37f04f0e1b7bb2155361047cb256764b6eb47d1cc8c87ccfa1beaa","observation_id":"c203d6cb-65ae-4b5e-9703-e641c0e661e3","resolution":{"observed_at":"2026-08-07T15:42:44.443084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.021785Z","title":"degree at the same institution, under the supervision of Prof","venue":null,"work_id":"15c8444c-edfd-4a1e-afd6-81e5638fa545","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:43.089424Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:9ab0adb4a46b16f9bb0ce445a0221533b1abac5695c9c6b16b51ce7ab1bdd38c","observation_id":"a557bfc1-3d13-4617-948b-42165aa6fef2","resolution":{"observed_at":"2026-08-07T15:42:44.130662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.191300Z","title":"degree at the same institution, under the supervision of Prof","venue":null,"work_id":"cb6ef03f-38f3-423d-8bf6-dccc71dcafba","year":null},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.956255Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:f6f87045f8926bb3608c813d7ff64f45159eb1d22cfca0e211508041856bc7ef","observation_id":"0f8e4b14-4df5-4bdc-88f9-7aabac3966c7","resolution":{"observed_at":"2026-08-07T15:42:44.263995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T15:36:11.604163Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":39},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.14209."}