{"as_of":"2026-08-09T02:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0fa560b8bc5404071fb53933f97776ffc0220bf59b77e6ed2e811a9a47e88239","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:36:01.708812Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18719/citation-record","integrity":"/paper/2607.18719/integrity","json":"/paper/2607.18719/citation-record.json","paper":"/paper/2607.18719"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1806.01946","last_updated":"2019-12-23T16:41:02Z","snapshot_observed_at":"2026-08-04T01:49:15.115504Z","submitted_at":"2018-06-05T22:01:51Z","title":"Learning to Understand Goal Specifications by Modelling Reward","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01946","snapshot_observed_at":"2026-08-01T14:35:58.826822Z","title":"Learning to understand goal specifications by modelling reward,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:58.826822Z"},"links":{"cited_paper":"/paper/1806.01946","citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:a65387f493f2820638943f3020827ef2c5d9ffe634840ebe64e3ebe6dc81b4e0","observation_id":"c4d897d4-29c6-490d-933d-65ab9b10ade1","resolution":{"observed_at":"2026-08-01T14:35:58.826822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00517","last_updated":"2021-09-26T14:53:21Z","snapshot_observed_at":"2026-08-04T07:27:07.838035Z","submitted_at":"2020-11-01T14:39:46Z","title":"Ask Your Humans: Using Human Instructions to Improve Generalization in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00517","snapshot_observed_at":"2026-08-01T14:35:58.982586Z","title":"Ask your humans: Using human instructions to improve generalization in reinforcement learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:58.982586Z"},"links":{"cited_paper":"/paper/2011.00517","citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:5be97924b96c3dc6a2696bc65c9311923dfca5bb76fdae16b42b2395cbf4bfb5","observation_id":"a70a5ff2-aa3f-430b-a609-d656c87e30cf","resolution":{"observed_at":"2026-08-01T14:35:58.982586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:59.112881Z","title":"Implicit quantile networks for distributional reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:59.112881Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:64b6548d9b0427324a311a0016bc00626dab1055894af20aae8730f291843c97","observation_id":"59a9f9a9-83d8-49be-b80a-2a714e789019","resolution":{"observed_at":"2026-08-01T14:35:59.112881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:59.280736Z","title":"Speaker- follower models for vision-and-language navigation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:59.280736Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:3a329ce8feb4ab3fe6db68f68f537f8a540b16e39ba2013f1fb20715e28e9517","observation_id":"b2633022-5b90-413b-b976-8475aff39cd3","resolution":{"observed_at":"2026-08-01T14:35:59.280736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:59.426740Z","title":"Hierarchical program- triggered reinforcement learning agents for automated driving,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:59.426740Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:b16c62ea466ba071a90731612c704733e37265f3edb632a1ac40184d036c3dbe","observation_id":"4021501e-a9e8-4c9a-98de-ca07834f5eba","resolution":{"observed_at":"2026-08-01T14:35:59.426740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:59.585344Z","title":"Cirl: Controllable imitative reinforcement learning for vision-based self-driving,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:59.585344Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:ec2604ef308f3e39b9c22bb884833cd8e4d74d49355a0b6d3888f269f804a290","observation_id":"e071932b-aaae-4483-8464-7346bb70bca1","resolution":{"observed_at":"2026-08-01T14:35:59.585344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00786","last_updated":"2019-03-18T17:04:24Z","snapshot_observed_at":"2026-08-05T16:56:27.342834Z","submitted_at":"2018-09-04T03:36:21Z","title":"Mapping Instructions to Actions in 3D Environments with Visual Goal Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00786","snapshot_observed_at":"2026-08-01T14:35:59.717941Z","title":"Mapping instructions to actions in 3d environments with visual goal prediction,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:59.717941Z"},"links":{"cited_paper":"/paper/1809.00786","citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:78935763149e1f12481c4b97f3702dd53c27da87a48fee757c9dc4d8d31c032d","observation_id":"4bc79385-cb73-4ba4-a861-3c1b1bc472e7","resolution":{"observed_at":"2026-08-01T14:35:59.717941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:59.850965Z","title":"Analysis of coordinated behavior structures with multi-agent deep reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:59.850965Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:ea2f75502545d9eb99ad8e4764032559fffc9d26b5aeb7b2d1f5549b8f50d4ef","observation_id":"38e4d5d0-f80e-4f4a-946e-af85c2f85e83","resolution":{"observed_at":"2026-08-01T14:35:59.850965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:35:59.968014Z","title":"Interpretability for conditional co- ordinated behavior in multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:35:59.968014Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:252e1d907da104020b1f97662bb1b0ab86148d1d900051eed241c37c73c54555","observation_id":"7b2af1ed-1193-494d-94db-78bc5344b516","resolution":{"observed_at":"2026-08-01T14:35:59.968014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:00.142659Z","title":"Strategy-following multi-agent deep reinforcement learning through external high-level instruction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:00.142659Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:8d79e576b0bafd9c47278ba9cdbf85a96f176101ad2f18dd174ce52f4d257378","observation_id":"e9f12557-d7f7-48d0-badb-15f5d24e0eb6","resolution":{"observed_at":"2026-08-01T14:36:00.142659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:00.334122Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:00.334122Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:1c2f4ff6889fd32fb94cf5be394ef6086991c072fd62e5b91f06f61dabdbcc04","observation_id":"5fec71b9-d086-4670-876d-db3aba18f3f6","resolution":{"observed_at":"2026-08-01T14:36:00.334122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01283","last_updated":"2017-03-03T19:58:56Z","snapshot_observed_at":"2026-07-06T05:13:22.674148Z","submitted_at":"2016-10-05T06:51:58Z","title":"EPOpt: Learning Robust Neural Network Policies Using Model Ensembles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01283","snapshot_observed_at":"2026-08-01T14:36:00.510306Z","title":"Epopt: Learning robust neural network policies using model ensembles,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:00.510306Z"},"links":{"cited_paper":"/paper/1610.01283","citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:5ca3088a471bf5202a23b590c1fc8f1d382120cfefabc7bcde24835215304a70","observation_id":"4426bf42-7569-4684-8472-cc6802b87a8c","resolution":{"observed_at":"2026-08-01T14:36:00.510306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:00.635131Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:00.635131Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:f697deb8e5c1a705d419980d8012043e2a4510de5cd849f8a608c8b36a38b968","observation_id":"8d4bfb62-2df5-4099-b524-3473ed7501de","resolution":{"observed_at":"2026-08-01T14:36:00.635131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-01T14:36:00.853580Z","title":"The starcraft multi-agent challenge,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:00.853580Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:3ddac06d62a0c8e9438e4cc7277386f231b05cd1bdd873bb46de9b7b57388fd2","observation_id":"f29c1eb2-9923-48e6-9b69-b4c50c397dd7","resolution":{"observed_at":"2026-08-01T14:36:00.853580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-03T05:49:14.071341Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-01T14:36:00.966006Z","title":"Safe, multi- agent, reinforcement learning for autonomous driving,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:00.966006Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:15bba230cbd293a4c11b45ed2029f4c416256e27151d414fe8f6a6d4c66c10da","observation_id":"f0fb071e-d947-4772-9e45-7ec5f919a554","resolution":{"observed_at":"2026-08-01T14:36:00.966006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:01.030417Z","title":"Task offloading and trajectory scheduling for uav-enabled mec networks: An madrl algorithm with prioritized experience replay,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:01.030417Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:4c0c411aaac0389b057d6f25d9218b11e1b5b4df49c009dbb6e3bbba17f76a58","observation_id":"da24faac-f0cc-4686-8792-e6507573961c","resolution":{"observed_at":"2026-08-01T14:36:01.030417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:01.180288Z","title":"Program guided agent,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:01.180288Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:df6d5bf8b62ea51cd0330e72a28f751b71576fa4e74f3fb418efe3c79a19a96c","observation_id":"457f68cf-5c46-487a-8daa-7713383c56f8","resolution":{"observed_at":"2026-08-01T14:36:01.180288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:01.310222Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:01.310222Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:2c19c2d0ffb462b772e1c9a3b7d25e7342d0ee3ab75696d198b5f5fd2a7dcb16","observation_id":"bcbbf0e7-5517-4b61-bfca-8cffc81f6c96","resolution":{"observed_at":"2026-08-01T14:36:01.310222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:01.389483Z","title":"Understanding natural language,","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:01.389483Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:0ea789f3d3c1350588f7834a888912d9382e96c5d4a24991c11c1c69f174ca48","observation_id":"409aac75-7301-4958-ac92-270275af07e9","resolution":{"observed_at":"2026-08-01T14:36:01.389483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:01.464775Z","title":"Toward human-in-the-loop ai: Enhancing deep reinforcement learning via real-time human guidance for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:01.464775Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:4de4e0c35b9c39d397be4e09132b82cc0c10ddb275d321100510ee3ff5ad2c40","observation_id":"4514b892-c853-4ff2-9209-44fe0a5d6d96","resolution":{"observed_at":"2026-08-01T14:36:01.464775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:01.597241Z","title":"Program synthesis guided reinforcement learning for partially observed environments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:01.597241Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:5bc7f5755ef053f67a5820d07164581be9ebee58dd569b43200bf975658e3507","observation_id":"aaf0ee00-3225-4951-ae76-e3b2370b72df","resolution":{"observed_at":"2026-08-01T14:36:01.597241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:36:01.708812Z","title":"Joint sensing and communication optimization in target-mounted stars-assisted vehicular networks: A madrl approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:01.708812Z"},"links":{"citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:096b03b1be172978a53de400167e7d24a20162b026d1a8dd14d354d2e2ba8822","observation_id":"3c66c4dc-028f-4165-8d36-acdb504def6b","resolution":{"observed_at":"2026-08-01T14:36:01.708812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2607.18719."}