{"as_of":"2026-08-14T19:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7735bd14ba51b4e46ccbbf088365256240e1feb89cebe6c3172b269b7150f86","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:22:09.722683Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T19:28:52.274750Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T19:28:52.638301Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.00534","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.00534","snapshot_observed_at":"2026-08-11T19:28:52.638301Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"fb3470e8-2670-4a1a-bd64-394e62d4e681","year":2024},"citing_paper":{"arxiv_id":"2412.06684","last_updated":"2024-12-14T11:06:37Z","snapshot_observed_at":"2026-08-13T22:50:22.807896Z","submitted_at":"2024-12-09T17:27:04Z","title":"Exploring Critical Testing Scenarios for Decision-Making Policies: An LLM Approach","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T19:28:52.274750Z"},"links":{"cited_paper":"/paper/2412.00534","citing_paper":"/paper/2412.06684"},"observation_digest":"sha256:5eb58d0b0d91faad78c030ebdb5fdb4e4de74588f0beb7989f40db95ea603ae2","observation_id":"ac8229a5-852d-41d9-ad84-737d7149333d","resolution":{"observed_at":"2026-08-11T19:28:52.644424Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.00534/citation-record","integrity":"/paper/2412.00534/integrity","json":"/paper/2412.00534/citation-record.json","paper":"/paper/2412.00534"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.539555Z","title":"Deep reinforcement learning for autonomous driving: A survey,","venue":null,"work_id":"dcc83cdc-42eb-4905-a19a-b83812b873df","year":2022},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.466136Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:20e20cca723382cb8123fcd2f95cb56e206ea9c45d7377f0629d5885c8597ae4","observation_id":"0ef39b6a-8f2d-4f3d-bc95-80bef705377f","resolution":{"observed_at":"2026-08-12T05:22:10.544565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.524220Z","title":"Distributed multi-vehicle task assignment and motion planning in dense environments,","venue":null,"work_id":"b4761fb8-3936-4dcf-b43b-364e8d6fca6a","year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.472272Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:87f25b06df5fa6a61c6f1b3d39a551dbd1c27c3f0140800e0c4a750cc7b3e32d","observation_id":"02149e4c-a161-4e55-b481-7c18aa4cb1ba","resolution":{"observed_at":"2026-08-12T05:22:10.529434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.509109Z","title":"A survey on multi- agent reinforcement learning applications in the internet of vehicles,","venue":null,"work_id":"a7b81919-2181-4a3e-b624-e941fa3f4486","year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.477116Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:3ffd3b84cb71035c66c743088a2f6cc90a85473c17e3f29dfcc01656908500eb","observation_id":"8b42275d-fba1-4b60-b9fc-5787d72d0022","resolution":{"observed_at":"2026-08-12T05:22:10.514197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.493899Z","title":"Theory and experiment on formation-containment control of multiple multirotor unmanned aerial vehicle systems,","venue":null,"work_id":"9f4b6c71-ff1a-47b3-87d9-98ed6acf0f28","year":2019},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.482163Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:3fd1925f36ae7d58fa4fee9687f13c008c36940139a951945b2bce0563ec9cfd","observation_id":"8cb1b92e-4780-4df8-b52e-499139071318","resolution":{"observed_at":"2026-08-12T05:22:10.498862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.478611Z","title":"Cooperative internet of uavs: Distributed trajectory design by multi-agent deep reinforcement learning,","venue":null,"work_id":"e5d80de2-9180-4c92-9161-9b76159e2c88","year":2020},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.487265Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:4c7ebb7035630576f9f93fb2a5462e45355693bb751c6c020732a80cf938227c","observation_id":"f0306bee-2680-44c6-b6b5-6a3e1a81ed80","resolution":{"observed_at":"2026-08-12T05:22:10.483609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.492232Z","title":"Heterogeneous multi-robot reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.492232Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:7f8e2030f094cef1b2036b8228765a48f22df48054b8d87a50877c7aa2d5dca7","observation_id":"5604ac6e-8397-4079-b61e-59edd446b198","resolution":{"observed_at":"2026-08-12T05:22:09.492232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.454293Z","title":"On the effects of communication failures in a multi-agent consensus network,","venue":null,"work_id":"38906420-f963-4c15-a372-e3070dd8efb0","year":2019},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.497616Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:5e590d8620fd28a10b0d3b67a9057eca870fd4c75efd76f68f661fe28e86019a","observation_id":"fd591eb3-54e0-4f71-b9f6-45b77ed9788b","resolution":{"observed_at":"2026-08-12T05:22:10.459235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.438354Z","title":"The impact of agent definitions and interactions on multiagent learning for coordination in traffic management domains,","venue":null,"work_id":"a4ea5972-246c-4963-b950-ce9cb1b078b2","year":2020},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.502419Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:3ed7f9bc527cdef7eb013e27ae206c2cf536a8f1a3889ea5e731157c22940b03","observation_id":"a10027c5-14bf-48ec-bc2d-5f621d29fc50","resolution":{"observed_at":"2026-08-12T05:22:10.444134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.423618Z","title":"Fault-tolerant cooperative control of multiagent systems: A survey of trends and methodologies,","venue":null,"work_id":"3dc65028-30aa-4862-a8e5-8a2e58f75cb5","year":2020},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.507161Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:966b936d20c1f270331e1363f8bfef62a79dfd287cf2e3b6a2508356dd53f13c","observation_id":"42d4a4d0-ae76-404d-babf-db761ca0b3e6","resolution":{"observed_at":"2026-08-12T05:22:10.428546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.408639Z","title":"Fault-tolerant cooperative control of multiagent systems: A survey of trends and methodologies,","venue":null,"work_id":"a1960914-97f3-4e46-94f5-e75a2e115e7b","year":2020},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.512052Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:1f93ad2b91188d25481b89ba5982097bc2ab9d6511bbe7f99ad4e78089ad180f","observation_id":"aaaee778-8470-425c-9848-1389f31a27fa","resolution":{"observed_at":"2026-08-12T05:22:10.413639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.393310Z","title":"Fault-tolerant consensus of leader–following multi-agent systems with jointly connected topologies,","venue":null,"work_id":"e64f9817-80a3-483c-ad2e-c4d4c51c7bc2","year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.516793Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:7dac26a19fb021dfacd5d454bb82ea3246f33c10a679c5b1c7d901562f02df93","observation_id":"d88154f3-590d-4c30-9103-2a4680edbef8","resolution":{"observed_at":"2026-08-12T05:22:10.398213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.378350Z","title":"Fault-tolerant formation for multi-uav via improved artificial potential field method,","venue":null,"work_id":"f4e4d0fe-9214-4a47-8f1a-ca572028b5b5","year":2021},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.521317Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:ae40e4ba0be3b6fa60ef94c0912642d12f605c4ef5941ce7a9cdbfb3836b8784","observation_id":"f8c816c0-6ecb-4262-8606-061d5dc73661","resolution":{"observed_at":"2026-08-12T05:22:10.383273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.362949Z","title":"Policy gradient methods for reinforcement learning with function approximation,","venue":null,"work_id":"9c5842d6-dd32-4873-8172-dc3c59f2d0f1","year":1999},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.526089Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:1cb55145b6096a877befd01a05f02e456b9036f574846af650fd5ec1241ad95c","observation_id":"258fada4-c201-43a9-8e77-01c1bad04081","resolution":{"observed_at":"2026-08-12T05:22:10.367941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.348249Z","title":"Multi-agent reinforcement learning with decentral- ized distribution correction,","venue":null,"work_id":"26551dcf-7f42-4feb-bc67-66e8fa406625","year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.530793Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:bf305991ce845ecddee9e4327a33bee32222ca6f5ff74e50721bffd6b67fa04f","observation_id":"1334f93f-0e8b-4e12-9a4b-1aa40f17bb29","resolution":{"observed_at":"2026-08-12T05:22:10.353476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.332412Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":"161dacf9-fe3a-41d5-a97a-bc6d677e7ffc","year":2017},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.535322Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:5de434f7673070dfd7c33c3a7ef40b9749b25bd5defe2d5a626574ad79ca711f","observation_id":"6171fcb6-9ed1-494d-9225-7a9c5e2d6209","resolution":{"observed_at":"2026-08-12T05:22:10.337665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.316887Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games,","venue":null,"work_id":"6205b8a8-c5c6-424e-b70b-66ef94d2214d","year":2022},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.539877Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:3c05cb3f7a8f66eaf329a0c9fdb08744342de1dccd1fa1eccdb74840a25685b7","observation_id":"9d2b276e-728d-488a-8681-3dc6d323c42e","resolution":{"observed_at":"2026-08-12T05:22:10.321728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.302126Z","title":"Prioritized experience replay,","venue":null,"work_id":"4557de12-a659-4917-9e32-1f7be7da805c","year":2016},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.544780Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:72a2eb1393618ef6e2e82645d85eddd70cdd65999954fcacb0d4acc4be0d4e0f","observation_id":"14218bdb-2ea6-48bb-9e11-be1778733a3c","resolution":{"observed_at":"2026-08-12T05:22:10.306904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.286173Z","title":"Towards a fault-tolerant multi-agent system architecture,","venue":null,"work_id":"5df46a13-a176-485c-876d-ce127c5bf9dd","year":2000},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.549183Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:8e8baf18b7dfc646456c03e2ddf489928ba48102d21119959c19f9d2b6fe9d19","observation_id":"9ad8e1a3-40cf-42ff-b466-9bee99a61da5","resolution":{"observed_at":"2026-08-12T05:22:10.291970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.271307Z","title":"A survey on fault tolerant multi agent system,","venue":null,"work_id":"ef489ac1-a1df-4f22-9efc-accfdd16300a","year":2016},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.553810Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:55b4de5ae75bef54a3066f4029cdcb8d80dc43466d498dadac8493fe0de39bc1","observation_id":"4e52e42a-8e2f-4624-9559-b0d513c7ee8a","resolution":{"observed_at":"2026-08-12T05:22:10.276061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.255423Z","title":"Adaptive fault-tolerant boundary control of an autonomous aerial refueling hose system with prescribed constraints,","venue":null,"work_id":"42d9b732-13fb-4cc0-9384-53d7f79aa408","year":2022},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.558575Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:590e84a890183c2b52701acf694b116f03cbf3f1829449e9a0c0239aa153517f","observation_id":"c2fb3118-444a-4c1d-87aa-8a0c187705c7","resolution":{"observed_at":"2026-08-12T05:22:10.260737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.239429Z","title":"A goa-based fault-tolerant trajectory tracking control for an underwater vehicle of multi-thruster system without actuator saturation,","venue":null,"work_id":"d7914d89-21a2-472a-a10c-ab0e7be81a0d","year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.563422Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:fc57fcd2f419e6ac6a2b0dbf6c42d838b9208c9bd5153060780383b3074914d8","observation_id":"3f25025c-149c-4ea3-b7ed-07163fbf7e69","resolution":{"observed_at":"2026-08-12T05:22:10.244285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.224540Z","title":"Fault-tolerant cooperative driving at signal-free intersections,","venue":null,"work_id":"f5140c14-ef72-45b2-a32b-ce136362b20f","year":2022},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.568080Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:8c551adadb73f732a128d1158e581c16e83767f102e097fd297bd3c169feac13","observation_id":"3bb7a928-8527-43a1-b731-49130c1e179a","resolution":{"observed_at":"2026-08-12T05:22:10.229370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.209648Z","title":"Fault-tolerant cooperative control design of multiple wheeled mobile robots,","venue":null,"work_id":"853c4ea1-876a-47bf-9804-28dc93480796","year":2018},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.572613Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:e28ae9b418876e2f090d8e2534ad69202fa97f86bcca802c79b9f9f1b582fbc8","observation_id":"3abc5b53-d14b-4aac-a2ab-d4ff4f9f6519","resolution":{"observed_at":"2026-08-12T05:22:10.214535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.194295Z","title":"Robust multi- agent reinforcement learning via minimax deep deterministic policy gradient,","venue":null,"work_id":"56ef797d-a710-4b35-88c3-6c15a4eaeb09","year":2019},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.576878Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:d3c6cb9d33254a8484e3801a3942d6c2b4ef5f2b35f6ba4a119d4e16eb611246","observation_id":"afa9543b-2763-4f44-9669-63ff2735f6ce","resolution":{"observed_at":"2026-08-12T05:22:10.199425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12872","last_updated":"2024-06-17T08:16:23Z","snapshot_observed_at":"2026-08-13T11:37:27.117695Z","submitted_at":"2023-05-22T09:50:59Z","title":"Byzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12872","snapshot_observed_at":"2026-08-12T05:22:09.581417Z","title":"Byzantine robust cooperative multi-agent reinforcement learning as a bayesian game,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.581417Z"},"links":{"cited_paper":"/paper/2305.12872","citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:1e9f9606185a4976732b8fd2e994bb2bd047a9a377cee0133b14224bc238312f","observation_id":"bd5bb53a-38a5-4ccd-a9eb-65007ce2c0ec","resolution":{"observed_at":"2026-08-12T05:22:09.581417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.179336Z","title":"QMIX: Monotonic value function factorisation for deep multi-agent reinforcement learning,","venue":null,"work_id":"45353420-2517-48e6-8f54-9d5b218171d7","year":2018},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.586181Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:e79306dae3e404b8318985495274d89570ab20e8caff771b8fa44fc78dacd78c","observation_id":"0ef13575-f180-404c-af0e-ae2b6765cf49","resolution":{"observed_at":"2026-08-12T05:22:10.184154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.590610Z","title":"Counterfactual multi-agent policy gradients,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.590610Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:687199f3de9ff099f39b2e31628292b2b6624b764de7c1695528209fc8aaa645","observation_id":"2d9f5118-7c3c-44df-8d55-2387f9483969","resolution":{"observed_at":"2026-08-12T05:22:09.590610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.154030Z","title":"Evolutionary population curriculum for scaling multi-agent reinforcement learning,","venue":null,"work_id":"2427d1b5-18df-4ecd-a122-cb33c74a24d7","year":2019},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.595066Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:efcc30fef26a12af7683692ebae963f04c49998559b4411fe4f907d00fef01da","observation_id":"4b937b0c-95be-456f-a81c-23adbaeac636","resolution":{"observed_at":"2026-08-12T05:22:10.159221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.138671Z","title":"Scalable autonomous separation assurance with heterogeneous multi-agent reinforcement learning,","venue":null,"work_id":"f2b937f5-4191-411c-8e0d-27e9971f25c1","year":2022},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.599722Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:674f3c9bc78bee0d86dcddaf07a9bcd973a2bae6b2b38d7705614e5d7a2fab64","observation_id":"8c3d8768-4139-49f6-81e1-8c999dccd855","resolution":{"observed_at":"2026-08-12T05:22:10.144161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.122004Z","title":"Asynchronous multi-agent reinforcement learning for efficient real-time multi-robot cooperative exploration,","venue":null,"work_id":"68bd55f3-af29-46b1-86bc-0e60a80ada91","year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.604174Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:dc469aa7e2ab7a3712409f9912bc2312105d89ab816af67bf9ab191be31c31d4","observation_id":"6968ca23-d612-4128-9164-b8c59ebb838c","resolution":{"observed_at":"2026-08-12T05:22:10.127665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.105515Z","title":"Race: improve multi-agent reinforcement learning with representation asymmetry and collaborative evolution,","venue":null,"work_id":"7036ad7c-4540-42d0-ab5e-34cc73761246","year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.608839Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:a4daf7b185a9258a45e1630cfa96950d1633de3bcba5c4194c9ed6a055daa753","observation_id":"70b76b4f-0de7-49e7-b5b3-02d52f148a6d","resolution":{"observed_at":"2026-08-12T05:22:10.110615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.090025Z","title":"Effective multi-agent deep reinforcement learning control with relative entropy regularization,","venue":null,"work_id":"dd92ffbe-286e-43f1-bb96-8187264c990c","year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.613216Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:205fcb813846f4026ccd15aad66f68797b688077a5250eda596e93e163e70a8e","observation_id":"495f4bb4-5859-4281-9b9d-fafc1d7c8091","resolution":{"observed_at":"2026-08-12T05:22:10.095039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.074655Z","title":"Multi-task multi- agent reinforcement learning with task-entity transformers and value decomposition training,","venue":null,"work_id":"6edb918a-faa7-4481-b378-fe1b051f9ea9","year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.618034Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:cc70ddb362921a5393fe4f523cdbeba2e1f2c7ec13889aa5f172c314b537ee77","observation_id":"c1eaa6fb-d84c-45e4-8f53-fcc45f27b21d","resolution":{"observed_at":"2026-08-12T05:22:10.079621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06684","last_updated":"2020-02-18T02:55:30Z","snapshot_observed_at":"2026-08-13T13:21:04.762024Z","submitted_at":"2020-02-16T21:25:44Z","title":"R-MADDPG for Partially Observable Environments and Limited Communication","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06684","snapshot_observed_at":"2026-08-12T05:22:09.623794Z","title":"R-maddpg for partially observable environments and limited communication,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.623794Z"},"links":{"cited_paper":"/paper/2002.06684","citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:b6ccfcadb0759d3fe89d89c45ca8f30890975d0955bac41311495ce3bb6de82d","observation_id":"ea7b6dc6-ded2-43df-9f8c-b711af13fd8e","resolution":{"observed_at":"2026-08-12T05:22:09.623794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00922","last_updated":"2018-12-03T17:27:41Z","snapshot_observed_at":"2026-08-14T17:49:21.881011Z","submitted_at":"2018-12-03T17:27:41Z","title":"Multi-agent Deep Reinforcement Learning with Extremely Noisy Observations","version":1},"cited_work":{"arxiv_id":"1812.00922","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.00922","snapshot_observed_at":"2026-08-12T05:22:09.820215Z","title":"Multi-agent Deep Reinforcement Learning with Extremely Noisy Observations","venue":"cs.LG","work_id":"5439a283-0bd4-48ee-a23f-57740096120a","year":2018},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.628959Z"},"links":{"cited_paper":"/paper/1812.00922","citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:e07660250dc80aefa41a569d56384a41d1261b1da82052076935326716f3e387","observation_id":"bc86a9c6-c263-4a78-9d7f-06f5cf8d9b8c","resolution":{"observed_at":"2026-08-12T05:22:09.827043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.060050Z","title":"A general survey on attention mechanisms in deep learning,","venue":null,"work_id":"ee96e9f8-9265-4795-8093-fae1afebdabb","year":2021},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.634357Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:3da9a448ff71f9494570aaed7504f55263cb09f3d14b740e752947da60d6c9bd","observation_id":"ee732337-c8b8-41d3-8e83-302355453081","resolution":{"observed_at":"2026-08-12T05:22:10.064923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.044419Z","title":"Neural machine translation by jointly learning to align and translate,","venue":null,"work_id":"ea4c3440-eef5-4e2b-9c87-5fd8b1bb7c22","year":2015},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.639520Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:3a5522b8e9e6418d436440e15de960a036508923edc60e2dead206a7d90839b3","observation_id":"b1882652-b2bd-4433-ab91-72120af3ce3a","resolution":{"observed_at":"2026-08-12T05:22:10.049561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.644089Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.644089Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:fbbe258cbdecbdba02490d2a9654e5f45810a8674bd01f50b392bb03e22fe566","observation_id":"65d3c800-807b-4493-ade8-9bf6cab96d02","resolution":{"observed_at":"2026-08-12T05:22:09.644089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-12T05:22:09.649369Z","title":"Large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.649369Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:4dcad0c6191d5e86aa70645cf7e6a0bc9176025a05a44e4e8b73152ff4f19144","observation_id":"6ba2b20f-7798-412e-a1e8-2f7dad889f7e","resolution":{"observed_at":"2026-08-12T05:22:09.649369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:10.020002Z","title":"Recurrent models of visual attention,","venue":null,"work_id":"2712293d-3ceb-49d7-88c1-966a1363e185","year":2014},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.654574Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:aaf1236f0e3ad1212250387b1c90d45a5b12cebda1deb3bcd8c5a696dfef5ef1","observation_id":"b2f587ee-4b3e-4c3a-bf79-827809965a3a","resolution":{"observed_at":"2026-08-12T05:22:10.024852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.659264Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.659264Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:920624904741296988ea482fb06de7618abf35b1a68a80d42161f993fa5db215","observation_id":"c1d66f45-273c-4f6a-98d1-19d5fabc7689","resolution":{"observed_at":"2026-08-12T05:22:09.659264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.992207Z","title":"Actor-attention-critic for multi-agent reinforcement learning,","venue":null,"work_id":"97d96201-2366-4a1d-8d86-af6a4ca5ef16","year":2019},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.663893Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:1a1b0a08c1e4ea89834f674fea91a8cdbd1bd37d392197676a6a3ffad4add75d","observation_id":"191801cd-6a7f-4a8e-9feb-0ae4f20a7948","resolution":{"observed_at":"2026-08-12T05:22:09.997264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.977265Z","title":"Attention-based recurrence for multi-agent rein- forcement learning under stochastic partial observability,","venue":null,"work_id":"b6387c64-076d-4dfa-82a3-9b13335976ca","year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.668955Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:94580482451b2373cc95aa3b9e59c1aed2b599ad3ef61aad992ca1646ed761c0","observation_id":"1f890d80-f54e-4de1-adc4-a83312ed7550","resolution":{"observed_at":"2026-08-12T05:22:09.982142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04819","last_updated":"2024-03-02T11:43:52Z","snapshot_observed_at":"2026-08-13T05:07:28.574900Z","submitted_at":"2023-12-08T03:40:38Z","title":"Attention-Guided Contrastive Role Representations for Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04819","snapshot_observed_at":"2026-08-12T05:22:09.673402Z","title":"Attention- guided contrastive role representations for multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.673402Z"},"links":{"cited_paper":"/paper/2312.04819","citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:f085614f8c26b44ccf3a3132b7caf6f3e282589340a6d81283d820021afbeaab","observation_id":"80f40410-d8c9-4aaa-8315-3f267c55bccf","resolution":{"observed_at":"2026-08-12T05:22:09.673402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.962495Z","title":"Novel distributed grus based on hybrid self-attention mechanism for dynamic soft sensing,","venue":null,"work_id":"1f71f54b-2964-49aa-b09b-9d9b18bd8870","year":2024},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.678574Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:de1587f84a546f65f7dc8d912effcc666f0a94e6088e4b965d937941db45e576","observation_id":"c8791e80-f72a-4d9d-bf5b-ae067ef72627","resolution":{"observed_at":"2026-08-12T05:22:09.967218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.947703Z","title":"Learning from noisy labels with distillation,","venue":null,"work_id":"1508eef1-42f4-4488-bf53-3926731f54a2","year":2017},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.683251Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:250e6ff7cc7ee58116688f39d639f54260fae59c8f6ff40880934dcb6c2dbfef","observation_id":"053d63a2-e868-499f-bca3-4a2781eded09","resolution":{"observed_at":"2026-08-12T05:22:09.952556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.932277Z","title":"Curriculum reinforcement learning from avoiding collisions to navigating among movable obstacles in diverse environments,","venue":null,"work_id":"7536f9fe-7baf-42db-b3ad-d9f76b223166","year":2023},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.687886Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:0562e22d522e27788f6f0f1abb7b23d6fa0eb04167407980600640390d88b8f5","observation_id":"e55e301d-8c95-405f-92ef-f574644d8939","resolution":{"observed_at":"2026-08-12T05:22:09.937232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.692721Z","title":"Training region-based object detectors with online hard example mining,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.692721Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:b3339b17d3079936a052f882aa0ac82b30e4af8daaa968bb6a06739ac5e719c6","observation_id":"6abb803a-19f4-4760-9108-5abe83fcfddf","resolution":{"observed_at":"2026-08-12T05:22:09.692721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.908382Z","title":"Markov games as a framework for multi-agent rein- forcement learning,","venue":null,"work_id":"dda9c6d5-4bee-467d-8a1a-0620112952cd","year":1994},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.697574Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:6dd0cdef1b48e4fde50654f6a59da22fdef8e2c05d7beec33bb29d86a0df7e34","observation_id":"25d69e2b-8179-4899-8af9-272d865f768b","resolution":{"observed_at":"2026-08-12T05:22:09.913197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.893264Z","title":"Planning and acting in partially observable stochastic domains,","venue":null,"work_id":"fa53c156-3e0c-4a25-8dca-9ceb27750532","year":1998},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.702321Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:7a90be0e1c93dc054470a3f6997f5953402164be1b20d46458d08f6047bfc275","observation_id":"09988ba2-3786-41d3-b537-8435bf29f365","resolution":{"observed_at":"2026-08-12T05:22:09.898186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.878242Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":"6d3337ef-1553-4308-9e52-3deb84d4720e","year":2016},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.706728Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:00319905b56204e6c408fb43deb172068bd58e85d4c5cfc6af24db740e4d749b","observation_id":"26dde8a6-cab0-4f40-ac81-0afd5993a78b","resolution":{"observed_at":"2026-08-12T05:22:09.883105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.09381","last_updated":"2018-06-29T00:19:24Z","snapshot_observed_at":"2026-08-05T03:37:42.195185Z","submitted_at":"2017-12-26T19:43:59Z","title":"RLlib: Abstractions for Distributed Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.09381","snapshot_observed_at":"2026-08-12T05:22:09.711386Z","title":"Ray rllib: A composable and scalable reinforcement learning library,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.711386Z"},"links":{"cited_paper":"/paper/1712.09381","citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:ca723d8c28ae2a7a153573ade12db32e3eb9e49a3337683834fc1d1b9191e4b2","observation_id":"6818dc0f-6a56-4ce8-8f52-27eb888893bb","resolution":{"observed_at":"2026-08-12T05:22:09.711386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01500","last_updated":"2019-09-24T06:22:31Z","snapshot_observed_at":"2026-08-14T14:58:02.543459Z","submitted_at":"2019-09-03T23:57:13Z","title":"rlpyt: A Research Code Base for Deep Reinforcement Learning in PyTorch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01500","snapshot_observed_at":"2026-08-12T05:22:09.716785Z","title":"rlpyt: A research code base for deep reinforcement learning in pytorch,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.716785Z"},"links":{"cited_paper":"/paper/1909.01500","citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:3172665d7e4435d0ccff916f97629980a1df8dcad8a0c3c96827d067155728b2","observation_id":"5130b66b-b7bf-41fc-a2e8-19851e9801e3","resolution":{"observed_at":"2026-08-12T05:22:09.716785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:22:09.722683Z","title":"Experiment tracking with weights and biases,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T05:22:09.722683Z"},"links":{"citing_paper":"/paper/2412.00534"},"observation_digest":"sha256:7bc70aa57eaf8704cd318a37f9da13fc8023c0eef02c97c7177b1d7a3b94c37b","observation_id":"0769e7bb-b4a0-4c92-8473-4d708b32184f","resolution":{"observed_at":"2026-08-12T05:22:09.722683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.00534","last_updated":"2024-11-30T16:56:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T17:35:18.641190Z","submitted_at":"2024-11-30T16:56:29Z","title":"Towards Fault Tolerance in Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":41},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2412.00534."}