{"as_of":"2026-08-11T01:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5d77eacf4bde2c23c8158793e7e4651ca7efb65dda1b02ad99c0d4be8090477","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:38:36.581037Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-25T05:26:38.670814Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-10T22:38:36.581037Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01140","last_updated":"2025-01-02T08:47:12Z","snapshot_observed_at":"2026-08-10T22:32:15.133219Z","submitted_at":"2025-01-02T08:47:12Z","title":"Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T22:38:36.581037Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2501.01140"},"observation_digest":"sha256:1192884bf2b271b00d6f17a224b8eacaf230b5f77a8925e86e117d1c3f4a576a","observation_id":"950c9c9d-40a0-4b68-a390-3907c494525f","resolution":{"observed_at":"2026-08-10T22:38:36.581037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-10T15:42:33.266206Z","title":"Dealing with non-stationarity in multi-agent deep reinforcement learning","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2501.13727","last_updated":"2025-04-01T12:59:50Z","snapshot_observed_at":"2026-08-10T18:15:43.040827Z","submitted_at":"2025-01-23T15:01:19Z","title":"Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T15:42:33.266206Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2501.13727"},"observation_digest":"sha256:5f5bd387140b024638de4fe396c176285808cbab48fb175e361e1b7331440a06","observation_id":"757a0885-56dc-49e2-b780-42628ca23c2b","resolution":{"observed_at":"2026-08-10T15:42:33.266206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1906.04737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","venue":"cs.LG","work_id":"8a635422-e918-4c23-8466-06f330515a49","year":2019},"citing_paper":{"arxiv_id":"2506.07548","last_updated":"2026-05-06T13:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T08:38:18Z","title":"Overcoming Environmental Meta-Stationarity in MARL via Adaptive Curriculum and Counterfactual Group Advantage","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T11:08:51.426575Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2506.07548"},"observation_digest":"sha256:ba11efa3fa483572600e92cccc6fe28dfba640ba7a92557d06d384ff45ad5f95","observation_id":"b941258a-95ae-4172-a86d-9435420f5286","resolution":{"observed_at":"2026-05-19T11:12:15.549194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-06T20:39:08.396975Z","title":"Papoudakis, F","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02211","last_updated":"2025-07-04T13:32:01Z","snapshot_observed_at":"2026-08-10T15:05:56.591701Z","submitted_at":"2025-07-03T00:17:53Z","title":"Dilution, Diffusion and Symbiosis in Spatial Prisoner's Dilemma with Reinforcement Learning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T20:39:08.396975Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2507.02211"},"observation_digest":"sha256:fd46a65f352da7f0b0686024020053d1f7202f00309a6d8ed305b4c0444b2b03","observation_id":"8928dc84-dfe8-4279-a17d-623ef983419a","resolution":{"observed_at":"2026-08-06T20:39:08.396975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-06T17:57:08.564397Z","title":"Deal- ing with non-stationarity in multi-agent deep reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-10T23:18:40.228565Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.564397Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:4d064ca6be704e35fce46b483697f4e6bbbef519cc01ee891cfa79922725be8e","observation_id":"c582f253-617e-48fb-9a90-ed2562f6f5a2","resolution":{"observed_at":"2026-08-06T17:57:08.564397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-06T10:40:38.836637Z","title":"Deal- ing with non-stationarity in multi-agent deep reinforcement learning.arXiv preprint arXiv:1906.04737, 2019","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.23604","last_updated":"2026-06-30T11:26:47Z","snapshot_observed_at":"2026-08-07T03:53:17.805976Z","submitted_at":"2025-07-31T14:42:12Z","title":"Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T10:40:38.836637Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2507.23604"},"observation_digest":"sha256:c03be2b69f71b1707e2cb5f4d6fe3910e129afaeff30cfd32374ecdabc144496","observation_id":"397a6f5a-5d19-4706-83c2-123c19e6e388","resolution":{"observed_at":"2026-08-06T10:40:38.836637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-05T19:01:24.672474Z","title":"CoRR abs/1906.04737 (2019)","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2508.14131","last_updated":"2025-08-19T09:13:36Z","snapshot_observed_at":"2026-08-07T02:43:14.789364Z","submitted_at":"2025-08-19T09:13:36Z","title":"An Improved Multi-Agent Algorithm for Cooperative and Competitive Environments by Identifying and Encouraging Cooperation among Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.672474Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2508.14131"},"observation_digest":"sha256:459c32ae12efda5fda7410bafed0b3a70aa90f25931a995665088513289deaff","observation_id":"5dac44fd-5103-4128-96ab-8a5ba1832ab6","resolution":{"observed_at":"2026-08-05T19:01:24.672474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-04T18:09:37.656673Z","title":null,"venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2509.10147","last_updated":"2025-09-12T11:20:11Z","snapshot_observed_at":"2026-08-06T04:22:58.599012Z","submitted_at":"2025-09-12T11:20:11Z","title":"Virtual Agent Economies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:09:37.656673Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2509.10147"},"observation_digest":"sha256:34289e12e203bc137045714b69b45b3fc1c8ef380618d0472ae73c57d867ef42","observation_id":"f4606db2-984e-4b12-8f92-4321f25089d2","resolution":{"observed_at":"2026-08-04T18:09:37.656673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-03T02:40:00.430146Z","title":"Dealing with non-stationarity in multi-agent deep reinforcement l earning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.09994","last_updated":"2026-07-21T13:12:09Z","snapshot_observed_at":"2026-08-09T20:52:05.396571Z","submitted_at":"2026-02-10T17:18:56Z","title":"ORCHID: Fairness-Aware Orchestration in Mission-Critical Air-Ground Integrated Networks","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T02:40:00.430146Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2602.09994"},"observation_digest":"sha256:f4f4b53337ce4047c4a09839540a8ce00152c745a17534d212bf3ad632424af4","observation_id":"5e5fec68-5039-4239-8f19-c9b33140ac99","resolution":{"observed_at":"2026-08-03T02:40:00.430146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1906.04737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","venue":"cs.LG","work_id":"8a635422-e918-4c23-8466-06f330515a49","year":2019},"citing_paper":{"arxiv_id":"2603.18396","last_updated":"2026-05-19T13:23:29Z","snapshot_observed_at":"2026-08-09T16:07:47.593227Z","submitted_at":"2026-03-19T01:37:45Z","title":"RE-SAC: Disentangling aleatoric and epistemic risks in bus fleet control: A stable and robust ensemble DRL approach","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T09:54:43.186846Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2603.18396"},"observation_digest":"sha256:7f9cf3aa18d00c7e691c4eb32af906c74e77d1ee1d0c9172ee7f20e43c79890a","observation_id":"b8dfa37d-8754-48ba-a3f5-a8e1f19ed998","resolution":{"observed_at":"2026-05-21T09:54:58.227217Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1906.04737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","venue":"cs.LG","work_id":"8a635422-e918-4c23-8466-06f330515a49","year":2019},"citing_paper":{"arxiv_id":"2604.09028","last_updated":"2026-04-10T06:46:29Z","snapshot_observed_at":"2026-08-10T21:26:32.867360Z","submitted_at":"2026-04-10T06:46:29Z","title":"Plasticity-Enhanced Multi-Agent Mixture of Experts for Dynamic Objective Adaptation in UAVs-Assisted Emergency Communication Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T16:55:19.978358Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2604.09028"},"observation_digest":"sha256:53c0b0e8696520cc85acee6c42433d713851b2dbc930fbf2ca0bc399884427ba","observation_id":"2e3cefc1-c2ba-4fcf-8788-ef36ba0967b8","resolution":{"observed_at":"2026-05-11T07:55:58.927572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1906.04737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","venue":"cs.LG","work_id":"8a635422-e918-4c23-8466-06f330515a49","year":2019},"citing_paper":{"arxiv_id":"2605.13131","last_updated":"2026-05-13T08:01:20Z","snapshot_observed_at":"2026-08-03T09:39:30.553371Z","submitted_at":"2026-05-13T08:01:20Z","title":"ERPPO: Entropy Regularization-based Proximal Policy Optimization","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-14T19:32:24.940497Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2605.13131"},"observation_digest":"sha256:9ab36e1dfc8f1fb4c8508b52a49839eb53ead9c3624c10c5f3d7c96072321506","observation_id":"b9cee4e3-a59e-489d-bc31-c50375ae4387","resolution":{"observed_at":"2026-05-14T19:32:51.861444Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1906.04737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","venue":"cs.LG","work_id":"8a635422-e918-4c23-8466-06f330515a49","year":2019},"citing_paper":{"arxiv_id":"2605.18281","last_updated":"2026-05-18T12:12:16Z","snapshot_observed_at":"2026-07-06T23:29:09.538843Z","submitted_at":"2026-05-18T12:12:16Z","title":"Temporal Task Diversity: Inductive Biases Under Non-Stationarity in Synthetic Sequence Modelling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-20T12:32:05.391155Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2605.18281"},"observation_digest":"sha256:9af9c73179886a94d235b01dad8cbba8956c37087d34875300dc3789f07286e0","observation_id":"f69b792e-9dc2-40ea-a966-6795dddf6b72","resolution":{"observed_at":"2026-05-20T12:33:16.811585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1906.04737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","venue":"cs.LG","work_id":"8a635422-e918-4c23-8466-06f330515a49","year":2019},"citing_paper":{"arxiv_id":"2605.23027","last_updated":"2026-05-21T20:50:47Z","snapshot_observed_at":"2026-07-06T23:33:19.375527Z","submitted_at":"2026-05-21T20:50:47Z","title":"PIMbot: A Self-Adaptive Attack Framework for Adversarial Manipulation of Multi-Robot Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-25T05:26:22.623367Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2605.23027"},"observation_digest":"sha256:0266af1bcfe883080219c88b7df6eeea12a20f1d1689f7fc46704c9f24ef4daf","observation_id":"2e530a45-7265-4dcc-8abf-393d477395f0","resolution":{"observed_at":"2026-05-25T05:26:38.673729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":"Christianos, et al","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:a01dc6e3c056101cc48a2a4aafa3ecc4c57ed4971ff20c23f8390bc0d4a870ab","observation_id":"f8763d9c-0239-4c1e-be38-5e267389d196","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04737","snapshot_observed_at":"2026-08-01T16:44:56.264226Z","title":"arXiv preprint arXiv:1906.04737 , year=","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.17922","last_updated":"2026-07-20T13:19:58Z","snapshot_observed_at":"2026-08-09T02:39:56.254899Z","submitted_at":"2026-07-20T13:19:58Z","title":"PRIME: Plasticity Recovery in Multi-Agent Environments for UAV-Assisted Emergency Communication Networks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T16:44:56.264226Z"},"links":{"cited_paper":"/paper/1906.04737","citing_paper":"/paper/2607.17922"},"observation_digest":"sha256:0568c67f39ef77f965f3851bd7f2a4c88d285d321103e6ad40b83d9a6f330c81","observation_id":"73d5b700-0d51-42e6-ab76-52199d439339","resolution":{"observed_at":"2026-08-01T16:44:56.264226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1906.04737/citation-record","integrity":"/paper/1906.04737/integrity","json":"/paper/1906.04737/citation-record.json","paper":"/paper/1906.04737"},"outbound":[],"paper":{"arxiv_id":"1906.04737","last_updated":"2019-06-11T09:42:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-01T21:07:35.425706Z","submitted_at":"2019-06-11T09:42:00Z","title":"Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:1906.04737."}