{"as_of":"2026-08-11T19:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9a9a6c9d3e871f3d9a98867e4beb329b1b038f6d638f974f792745d18f147bd9","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:38:36.779111Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.01140/citation-record","integrity":"/paper/2501.01140/integrity","json":"/paper/2501.01140/citation-record.json","paper":"/paper/2501.01140"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.473524Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.473524Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:4a43f7486dae8aa1a5066e3def3d3a2667a671dff723793cab3549c776eb8c40","observation_id":"db2c3f39-4620-4f79-b554-b98945154c0e","resolution":{"observed_at":"2026-08-10T22:38:36.473524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.517629Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.517629Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:71bc3f36fc8b33ef06a4fd45c10716430f9639a70fa78f0ad5b1a35c0162eb64","observation_id":"b0395251-1b83-4714-9a56-d9f0df15e731","resolution":{"observed_at":"2026-08-10T22:38:36.517629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.06614","last_updated":"2025-07-14T07:57:25Z","snapshot_observed_at":"2026-08-08T02:14:59.985333Z","submitted_at":"2021-11-12T09:03:19Z","title":"Collaboration Promotes Group Resilience in Multi-Agent RL","version":3},"cited_work":{"arxiv_id":"2111.06614","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.06614","snapshot_observed_at":"2026-08-10T22:38:36.944643Z","title":"Collaboration Promotes Group Resilience in Multi-Agent RL","venue":"cs.LG","work_id":"ef28cd89-19b0-4231-8060-cdabba486e9b","year":2021},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.522742Z"},"links":{"cited_paper":"/paper/2111.06614","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:5f88967f3028df0caa88e9c4ea3b81a0552f1c38145769b6af0b6acb87a18238","observation_id":"5b743987-6f10-4982-b798-117a228eafcd","resolution":{"observed_at":"2026-08-10T22:38:36.948932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-10T22:38:36.527784Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.527784Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:6a803361a29622f88aa46611c8f679ec3dfeb82525d232b22bc275d3fb73ebd5","observation_id":"be818ec0-6d09-4622-8179-6dbbe1a720d0","resolution":{"observed_at":"2026-08-10T22:38:36.527784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02541","last_updated":"2023-08-01T14:43:10Z","snapshot_observed_at":"2026-08-11T02:02:00.688171Z","submitted_at":"2023-08-01T14:43:10Z","title":"Towards More Human-like AI Communication: A Review of Emergent Communication Research","version":1},"cited_work":{"arxiv_id":"2308.02541","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.02541","snapshot_observed_at":"2026-08-10T22:38:36.910813Z","title":"Towards More Human-like AI Communication: A Review of Emergent Communication Research","venue":"cs.CL","work_id":"df6004aa-cc82-438d-bc97-79ca3b228c8c","year":2023},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.537241Z"},"links":{"cited_paper":"/paper/2308.02541","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:30cd970bd852684c0f84a7f20cc6484e00f0b1853f61d502735904c8f3ec8956","observation_id":"9f9562f4-fbe3-4d81-8708-5cc831cca106","resolution":{"observed_at":"2026-08-10T22:38:36.917573Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1259","last_updated":"2014-10-07T18:08:30Z","snapshot_observed_at":"2026-07-06T03:53:24.366023Z","submitted_at":"2014-09-03T21:03:41Z","title":"On the Properties of Neural Machine Translation: Encoder-Decoder Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1259","snapshot_observed_at":"2026-08-10T22:38:36.542640Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.542640Z"},"links":{"cited_paper":"/paper/1409.1259","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:2ef73fd10cd146cf5e8b84a8bf2f1b0dd8431b7fac630bf5e6411d3da2bf5f09","observation_id":"8308646f-2f04-4f8d-bce1-eb8dbd203f06","resolution":{"observed_at":"2026-08-10T22:38:36.542640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.09183","last_updated":"2019-03-11T20:17:29Z","snapshot_observed_at":"2026-07-06T05:53:08.086224Z","submitted_at":"2017-07-28T10:49:41Z","title":"A Survey of Learning in Multiagent Environments: Dealing with Non-Stationarity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.09183","snapshot_observed_at":"2026-08-10T22:38:36.547092Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.547092Z"},"links":{"cited_paper":"/paper/1707.09183","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:dd6ac329b6750e6772f8ab732e743dab4a31d916e30d5f71dc323ea366f4ed29","observation_id":"505fbf32-d5b7-4d9e-befd-cf790f36eeb9","resolution":{"observed_at":"2026-08-10T22:38:36.547092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:37.397209Z","title":"Z.; and De Freitas, N","venue":null,"work_id":"be40e766-125a-469d-9e0c-94485fa35f99","year":2019},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.551740Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:121b6a74b49a8ed6d4d69571ad1be080d7a94be38a30f18756754222eb905b1c","observation_id":"14f1bb75-d19c-4aa7-8a11-670d7ac65154","resolution":{"observed_at":"2026-08-10T22:38:37.401495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:37.378253Z","title":null,"venue":null,"work_id":"31ffffd4-60b7-4682-ac1d-a3ceaadd499d","year":2018},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.555996Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:ffc0907ee4e82f1443876e084a7b2fbbb07ecea354cff7f8bc35026fa84b2582","observation_id":"6230ed12-75b1-4066-9add-994f5bb6b1b7","resolution":{"observed_at":"2026-08-10T22:38:37.384319Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T22:38:36.560110Z","title":"P.; and Ba, J","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.560110Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:097741ec445342831c251a251bf47fb02d6292d7de62704b06cb04a99b589917","observation_id":"e816e211-823b-452b-bc90-70b8abdd02cd","resolution":{"observed_at":"2026-08-10T22:38:36.560110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.564416Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.564416Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:1bee99b3eb9abad06ec8625d33e867316e3736bca3f4dc525e23f75dcacbfa5d","observation_id":"fb7408ce-37c3-4fbd-94ab-47df22e81e6c","resolution":{"observed_at":"2026-08-10T22:38:36.564416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:37.355384Z","title":null,"venue":null,"work_id":"2a3aa59c-0bdd-4d1e-a5e5-fe8440d01261","year":2021},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.568448Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:fb553720b8a2125745ec2d5471cb6749f1268589cbaaafe52f31a35d1b430497","observation_id":"a60ff779-a76b-4ac4-aadf-6f0373abc632","resolution":{"observed_at":"2026-08-10T22:38:37.359138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:37.342689Z","title":"P.; Mirza, M.; Graves, A.; Lillicrap, T.; Harley, T.; Silver, D.; and Kavukcuoglu, K","venue":null,"work_id":"210c721b-82a0-4823-9bf4-42ebccaa6f4e","year":2016},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.572457Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:a75034e2e683f253a5a79c6f0b24968ff9b1f22a852b0953cfafd96d5a0c7d29","observation_id":"c53d4496-15cf-4a0b-90be-f2261e0b3aeb","resolution":{"observed_at":"2026-08-10T22:38:37.347427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:37.329456Z","title":"A.; Spaan, M","venue":null,"work_id":"b30e4b30-ae4b-40fd-a2e3-f9b476cdc1d9","year":2008},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.576314Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:81adb7740bb662a40096e116b2ef28da4c2c75a7fe260692d35da42a63d38575","observation_id":"843822d3-cdd3-4004-aa02-2dc875ddbd3f","resolution":{"observed_at":"2026-08-10T22:38:37.333865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-10T22:38:36.581037Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.581037Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:4ac5002744b6359477d25f6a57de056395d2c8ae29dd859f8d441d8d00c0ff2e","observation_id":"950c9c9d-40a0-4b68-a390-3907c494525f","resolution":{"observed_at":"2026-08-10T22:38:36.581037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-08-09T21:21:10.717989Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-08-10T22:38:36.585234Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.585234Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:b6d0663a07ef34338548c8e9282df87fab59491f98f4eae2a2d8b53dc8186ac3","observation_id":"b59c4fb2-8a3e-4b2f-b114-89373830a529","resolution":{"observed_at":"2026-08-10T22:38:36.585234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.655000Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.655000Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:4fad4270b51ae396f5e0e93481aaf7fed9a514047aff69c017a83a09d32129cd","observation_id":"9953bf78-8e0e-469f-ae7d-fdf8d10bc256","resolution":{"observed_at":"2026-08-10T22:38:36.655000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T22:38:36.710311Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.710311Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:b168bee131be43355d5af207d4764f1797a6553c71d8f962137c66803563c3b2","observation_id":"ed21faa9-9351-4720-973d-01a6a2ac2efd","resolution":{"observed_at":"2026-08-10T22:38:36.710311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:37.200632Z","title":null,"venue":null,"work_id":"6d7a4997-0443-44a6-b7b8-78e3beea0d56","year":2022},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.750710Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:17f00fa4bfe26393b7a75710cf4e787a101a119fee36a24d46bcc001baf2cbc3","observation_id":"11d50dab-777d-4aa6-8079-ca41f1af57fd","resolution":{"observed_at":"2026-08-10T22:38:37.260269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.754316Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.754316Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:417ddb452d89535e3e6e727f5ea1dfca38148232b47dba8c64fa2963e58a5de9","observation_id":"d2191c56-3cbd-401a-a726-7af876b5931d","resolution":{"observed_at":"2026-08-10T22:38:36.754316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.758680Z","title":"M.; Mathieu, M.; Dudzik, A.; Chung, J.; Choi, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.758680Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:482994b57b77dab40c07914bf5583e66665ff16b008fb2186814511001b72a3d","observation_id":"d49a1c87-7391-4239-a1a1-d4569a9968fe","resolution":{"observed_at":"2026-08-10T22:38:36.758680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01955","last_updated":"2022-11-04T06:16:11Z","snapshot_observed_at":"2026-08-11T01:59:05.518516Z","submitted_at":"2021-03-02T18:59:56Z","title":"The Surprising Effectiveness of PPO in Cooperative, Multi-Agent Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.01955","snapshot_observed_at":"2026-08-10T22:38:36.763423Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.763423Z"},"links":{"cited_paper":"/paper/2103.01955","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:0686654198ba6fb627d6d96d92ec7098e29226caf2d42ca63b498cd72abbcc77","observation_id":"0f004f2d-2d4a-41e9-9aa0-5cd19bb6144f","resolution":{"observed_at":"2026-08-10T22:38:36.763423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:37.085521Z","title":null,"venue":null,"work_id":"022ab98f-ff2a-465d-821f-c5b339398759","year":2021},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.768004Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:6044931bf4b0c26ac07c38e08e3acb58c7cd6b842f79e9d8db5b18cffb8e2139","observation_id":"2aaf596a-964c-4299-8df2-26f89bb5d277","resolution":{"observed_at":"2026-08-10T22:38:37.117732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.984195Z","title":null,"venue":null,"work_id":"06e23250-980e-4127-afa4-a49f7b60e6e5","year":2022},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.771945Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:cafd9b188aafc0d1a8b7339c285ebe0826c2e69f2ed0b58830653bd7061abedb","observation_id":"48404305-680a-402e-9ac6-a6ca976c5609","resolution":{"observed_at":"2026-08-10T22:38:37.029088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:38:36.957154Z","title":null,"venue":null,"work_id":"6987312e-ddf0-4051-90a6-8c29df2a5384","year":2021},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.775423Z"},"links":{"citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:cafc8663150254aed4d7d935104cff01c906ce30a69de709a61e2929c26c2031","observation_id":"7d2daf93-7dcc-4407-807e-1612a506cbb7","resolution":{"observed_at":"2026-08-10T22:38:36.960595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08975","last_updated":"2024-10-18T10:14:58Z","snapshot_observed_at":"2026-07-06T12:48:53.542296Z","submitted_at":"2022-03-16T22:39:46Z","title":"A Survey of Multi-Agent Deep Reinforcement Learning with Communication","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08975","snapshot_observed_at":"2026-08-10T22:38:36.779111Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.779111Z"},"links":{"cited_paper":"/paper/2203.08975","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:b84b5d54b7d624e3820f723fc1d074bd233cc83b188c8bdddaf89b6bdc253d15","observation_id":"38ce2feb-afc1-45db-8049-eacc59dfdc0a","resolution":{"observed_at":"2026-08-10T22:38:36.779111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-11T16:54:10.549193Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2501.01140."}