{"as_of":"2026-08-09T03:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c5ef3f52d84d2e55237cd461b395c1ce7e3c61b0e68cf58d74c1769e5859b234","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T20:01:01.783768Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.00374/citation-record","integrity":"/paper/2603.00374/integrity","json":"/paper/2603.00374/citation-record.json","paper":"/paper/2603.00374"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:56.840655Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:56.840655Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:fa2ac98a0ee2305645dbac244df9dbfb9f3cfbc2a21de0ee2596c0f1ef1bd3f9","observation_id":"b8a4d731-7b1a-43df-8282-42141ad3f973","resolution":{"observed_at":"2026-08-02T20:00:56.840655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:56.945625Z","title":"Oliehoek","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:56.945625Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:8042e96ef6910240f7fa01866a9a10818f0d9ff115cdc564e5b88ac663f2eb71","observation_id":"88662081-5889-4658-b455-cfdf6c67588a","resolution":{"observed_at":"2026-08-02T20:00:56.945625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:57.107588Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:57.107588Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:a9a4581b6bb1017dd1c07f29f7d0d76d31a6725a781d971b395e84287891a237","observation_id":"865da6ee-4020-4118-859c-2e977cee6c75","resolution":{"observed_at":"2026-08-02T20:00:57.107588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:57.364374Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:57.364374Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:58e744878b57123b84250aa432a6ed3feef84583143db80ada725e172ac0783b","observation_id":"4b04048d-98c7-4386-833d-0c1bb83eb601","resolution":{"observed_at":"2026-08-02T20:00:57.364374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:57.523867Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:57.523867Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:12d837ec429ccd8bdfaab0291cd7516f3c5eb05d4ece024c0e239ccb88dcbdce","observation_id":"c02c85c7-b47e-441e-80fe-477e8c56ec87","resolution":{"observed_at":"2026-08-02T20:00:57.523867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:57.724027Z","title":"Jordan, L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:57.724027Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:7394a5c928c3acd4b54e6bbaf739501784149ede36484671640c36ff7d16f164","observation_id":"27433f4d-510f-4bde-86b8-3104821cd001","resolution":{"observed_at":"2026-08-02T20:00:57.724027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:57.912270Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:57.912270Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:f91a8abe0d6e4a8efb5c12595fb5d843b8a4aa3fb70cb2806aa8594a1ca1c2db","observation_id":"3e18c2f1-5293-4f49-bb5f-ff3dd03097d2","resolution":{"observed_at":"2026-08-02T20:00:57.912270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:58.294674Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:58.294674Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:6aa8855d5493fac02cce24369a3ecde23d608c21ebd05c71b03b6cad8efef719","observation_id":"66ba1a5d-f145-4f62-956e-96090cda1195","resolution":{"observed_at":"2026-08-02T20:00:58.294674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:58.512968Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:58.512968Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:f33daacd46c65708db4ae26a98d23377c35b43164b7ed08fd32715b3210f9349","observation_id":"8e0ff4a7-971c-40b0-8934-cfa6ef6c5123","resolution":{"observed_at":"2026-08-02T20:00:58.512968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09453","last_updated":"2020-09-26T11:49:05Z","snapshot_observed_at":"2026-08-08T18:52:56.345158Z","submitted_at":"2019-08-26T03:31:35Z","title":"OpenSpiel: A Framework for Reinforcement Learning in Games","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09453","snapshot_observed_at":"2026-08-02T20:00:58.658391Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:58.658391Z"},"links":{"cited_paper":"/paper/1908.09453","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:6d9a6eaeae0e77e34383000b09e14263396a2ec3a519cf1acaf0ab7f2c8144b6","observation_id":"5dd000bf-ecd6-46ea-8875-e3405c0e350d","resolution":{"observed_at":"2026-08-02T20:00:58.658391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:58.815461Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:58.815461Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:95ba34485cc4b85511e8ef3ae92624e51d612ed31be377b95ce116e969fc430b","observation_id":"fa7989f8-1228-482a-9145-ac1ff7d1c36e","resolution":{"observed_at":"2026-08-02T20:00:58.815461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-02T20:00:58.981863Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:58.981863Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:7f5cc2dfb3527d838abbffc91aad2d6d5d419de4d5bd43082aef9d708ace9f7f","observation_id":"5aa4410a-6f85-4c8f-87c6-82e227245baf","resolution":{"observed_at":"2026-08-02T20:00:58.981863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:59.122213Z","title":"Dauphin, Devi Parikh, and Dhruv Batra","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:59.122213Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:84c153c7045f063a3b3987064aac2f97087d4bf4fdf9aded5c31252b672f82eb","observation_id":"407c7c40-5dea-4a1f-9f94-310838769a18","resolution":{"observed_at":"2026-08-02T20:00:59.122213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05285","last_updated":"2023-02-04T02:57:00Z","snapshot_observed_at":"2026-07-06T13:30:13.878336Z","submitted_at":"2022-07-12T03:41:06Z","title":"Offline Equilibrium Finding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05285","snapshot_observed_at":"2026-08-02T20:00:59.275949Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:59.275949Z"},"links":{"cited_paper":"/paper/2207.05285","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:bcb65e583c3cc0e88addc9bb087122871e05ffcc2750b480e3ad0092767a2ff1","observation_id":"859d2fa2-f003-45a0-9421-1492776d0378","resolution":{"observed_at":"2026-08-02T20:00:59.275949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:59.448889Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:59.448889Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:fa15e5cd3b7e4c3c00219dc3345aa9d421ebe5e292515114c081828ec583fb23","observation_id":"ecd6009b-c694-47e0-b572-ce6d326122ee","resolution":{"observed_at":"2026-08-02T20:00:59.448889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:59.644368Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:59.644368Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:8a243b4139b1adb5beab195f8dbed7017a74f572c8cd4c603cb4b113b95f3156","observation_id":"5592f7d6-561f-4126-9855-4f9e8715e8f9","resolution":{"observed_at":"2026-08-02T20:00:59.644368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-02T20:00:59.794174Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:59.794174Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:5177000225c7446ef434fef2256d482b767ab638d665d0eb2aa2ce13beb61c0a","observation_id":"8c855bbf-d81e-4ed2-96fa-809fc3bce318","resolution":{"observed_at":"2026-08-02T20:00:59.794174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:59.890270Z","title":"Nguyen, Anri Gu, and Michael P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:59.890270Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:3bc95ce87b81387fafd570a6164ba24dc03c3eb9bb5244cc0c05f9cd36715089","observation_id":"25c31cce-2b85-416b-8097-ebb1fce56078","resolution":{"observed_at":"2026-08-02T20:00:59.890270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-02T20:00:59.995893Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:59.995893Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:a50514abe9c00c415e12a537ca1285b2ffa0aed4c0645167a7152d3ea0358d6e","observation_id":"614b06e6-7547-43fc-a7d1-a3c8304666c8","resolution":{"observed_at":"2026-08-02T20:00:59.995893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:00.158264Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:00.158264Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:75273cd337430dd7c3dd17e6278b568e61326e2e4216087c9b3742a562dcb3ba","observation_id":"da9d6d66-7bd0-4846-af95-957c194bc352","resolution":{"observed_at":"2026-08-02T20:01:00.158264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:00.270556Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:00.270556Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:a76e71e81f5f598a9dff0fffbaa187500b529c7e06834b08db6d742097b35ba1","observation_id":"9ecb164a-f772-49a1-a9c8-6b34437589dc","resolution":{"observed_at":"2026-08-02T20:01:00.270556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:00.382623Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:00.382623Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:56e4c58c66582fda0734b3c0a2c50b4c5d9b4f6a39927a88a380e78df6f11154","observation_id":"770a2e72-ca67-4897-9dbb-b0fb48ef0797","resolution":{"observed_at":"2026-08-02T20:01:00.382623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:00.526747Z","title":"Taylor and Leo B","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:00.526747Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:62197eeef1e9e5102a489170a5097c3f590824c0709543892208e4be13d791fd","observation_id":"c9af3414-1a12-4b95-a3fb-f4048180498a","resolution":{"observed_at":"2026-08-02T20:01:00.526747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:00.686519Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:00.686519Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:cae4a9a798e46d230706b5903301018edbb7549017eba33ebdae2aa9a5fa3151","observation_id":"3616ee69-9c58-4c0c-b88c-d04cfa12d33a","resolution":{"observed_at":"2026-08-02T20:01:00.686519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:00.846625Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:00.846625Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:db8f6461fb5893f304a7242d4cde05015fa5c38bb740939d356d83d2a4847cf2","observation_id":"3c7325ad-6fb2-433d-a162-688c240469b0","resolution":{"observed_at":"2026-08-02T20:01:00.846625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:00.964388Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:00.964388Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:2a94f3f8170f5d51bb402dd1bcdc6ef9431f58e58bcfaff2e27ecb6032be3b8f","observation_id":"a9885b82-8baf-416a-96b5-e61f8ca00ea0","resolution":{"observed_at":"2026-08-02T20:01:00.964388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:01.092879Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.092879Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:e52d0648b280615687c6dd03530ee125a296d35df454ec0d4fa21bd1758c7bb5","observation_id":"728daa16-7d87-49c3-9706-bdd29937e934","resolution":{"observed_at":"2026-08-02T20:01:01.092879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:01.172695Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.172695Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:d40ecb380e7d370c105bf55e43e7711c94c5884511107bf875255e62630179fe","observation_id":"4244be16-b75c-453f-bde4-e4ae9ee79967","resolution":{"observed_at":"2026-08-02T20:01:01.172695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:01.281849Z","title":"Wellman, Karl Tuyls, and Amy Greenwald","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.281849Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:bc71b78fe44324ff40a911a43bf4c087b1dd8c21ec9933509fea0beb2c1d08e6","observation_id":"b1d9f1b3-862b-4bc8-9d38-3782e4f0d992","resolution":{"observed_at":"2026-08-02T20:01:01.281849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-07-06T08:39:58.361914Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-02T20:01:01.373185Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.373185Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:e1afbc7162476b8bafd5235d4f141d8838de3a168b2ef5af59e714971e767b4a","observation_id":"824c354f-8c00-4d96-9370-37f55efa3522","resolution":{"observed_at":"2026-08-02T20:01:01.373185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-02T20:01:01.525082Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.525082Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:4a190964cc33147a71b53f70c3d25130d14fdd195b08dd261b48a7b650ca4f63","observation_id":"4dcfe501-143d-4e7a-b0e8-fbbfaac4707c","resolution":{"observed_at":"2026-08-02T20:01:01.525082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:01.637130Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.637130Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:6ccee2b358549c9f906a7ce02ea7843b26392c3cdeddacd6a377852099053b7b","observation_id":"7dc7f34c-8a6b-437d-8d0c-9a5a8ed84549","resolution":{"observed_at":"2026-08-02T20:01:01.637130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:01.715439Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.715439Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:916c9526ed2e7f07111e0d61872a74937146bdcd2df014028f9b22800d706d3f","observation_id":"fdbf61db-4635-4998-ae89-bcfedfb13a67","resolution":{"observed_at":"2026-08-02T20:01:01.715439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:01:01.783768Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.783768Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:4a206195ab280e530e4fb988529964c5d23ffbfdc10b27a3996533346b94bf76","observation_id":"e0bcd494-aa95-4461-9aa6-35219b2e370d","resolution":{"observed_at":"2026-08-02T20:01:01.783768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:00:58.090766Z","title":"In 34th Annual Confer- ence on Neural Information Processing Systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T20:00:58.090766Z"},"links":{"citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:340dc18e05f2702c90e935b7c7a0484eb212ac34559eeb1bfde86782dfaacfc1","observation_id":"a29792ce-0fee-40bc-88f5-04d636551404","resolution":{"observed_at":"2026-08-02T20:00:58.090766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2603.00374."}