{"as_of":"2026-08-16T13:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56765185fb758c8592810aa51e699e3e0691a062284cfb022edd2372422d1853","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:42:46.233335Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.04573/citation-record","integrity":"/paper/1908.04573/integrity","json":"/paper/1908.04573/citation-record.json","paper":"/paper/1908.04573"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.674079Z","title":"Journal of Economic Dynamics and Control , 27(11):2207 – 2218, 2003","venue":null,"work_id":"b0f46345-9c86-45ad-92f0-23abe6d76d16","year":2003},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.090861Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:29ce3c24052d607524b2f365d81e0543473c9ec9dd053ea6181ec7f19a79ef6c","observation_id":"8edd8415-e090-4fc0-8768-de7cd50070c6","resolution":{"observed_at":"2026-08-14T13:42:46.678473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.662616Z","title":null,"venue":null,"work_id":"bde99af0-0f0b-45c2-ab2c-d4af499ba0cb","year":2004},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.095439Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:b998ecca39eaea254e2178f0e3e452b5c8f4e4dfdc9d182854396b9095c66d66","observation_id":"54dd1678-8039-454c-a204-fb8f519e9f2f","resolution":{"observed_at":"2026-08-14T13:42:46.666863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.02532","last_updated":"2017-04-08T20:04:03Z","snapshot_observed_at":"2026-08-15T07:36:00.816633Z","submitted_at":"2017-04-08T20:04:03Z","title":"Deep Reinforcement Learning framework for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.02532","snapshot_observed_at":"2026-08-14T13:42:46.099877Z","title":"Deep reinforcement learning framework for autonomous driving","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.099877Z"},"links":{"cited_paper":"/paper/1704.02532","citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:a0cd49144190df99adee91f39be0978ba7a994cc64ea61ce44dc4820a6193f0c","observation_id":"12880038-bed2-4c9f-8026-ae94f05958d4","resolution":{"observed_at":"2026-08-14T13:42:46.099877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.651482Z","title":"Learning exploration/exploitation strategies for single trajectory reinforcement learning","venue":null,"work_id":"5b86258b-0528-41c6-b5f5-9f6282bd1e21","year":2012},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.104836Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:c2a1cc13db0762d28eb8164fe3e2836ce13defaaf884445425a6abc8712870ac","observation_id":"370b9111-e8aa-49ce-bdfc-b87cad7b422f","resolution":{"observed_at":"2026-08-14T13:42:46.655422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.638941Z","title":"Papadimitriou and John N","venue":null,"work_id":"de0e860d-62b5-488f-a40f-40ca84a39c03","year":1987},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.109719Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:b5f6f911fa9c4dd86ebe55502624bdc942c77195e0c69de2dc220931704ea393","observation_id":"6798d111-1c15-4662-aca0-0f115115476c","resolution":{"observed_at":"2026-08-14T13:42:46.644069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.113490Z","title":"Littman, and Andrew W","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.113490Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:3bfeb059db73e16a67fa885e89bec029798e99e3d2d71948f6235bcdf579ac44","observation_id":"de953e4b-b0bf-4ad4-b134-096eb2d0d40a","resolution":{"observed_at":"2026-08-14T13:42:46.113490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.616444Z","title":"Foerster, Yannis M","venue":null,"work_id":"8c24138f-8ee1-47a3-987f-be312288936d","year":2016},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.118299Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:972281f0472420f2f227228c741f173d10937e8c117b75b82869b9a32461bbc7","observation_id":"4679c160-8724-4c08-9355-4d05b7468b00","resolution":{"observed_at":"2026-08-14T13:42:46.621725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.600378Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments","venue":null,"work_id":"c7e82092-b200-4e4e-a968-90c44f611b58","year":2017},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.121766Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:ccc0a4e15f50f6e7890e2c2986ee7c7edefd04e9f43658b246a76f8438b6d637","observation_id":"fbceb09e-f765-4f38-8f17-39fe0c10e8a0","resolution":{"observed_at":"2026-08-14T13:42:46.606911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.587948Z","title":"Foerster, Gregory Farquhar, Triantafyllos Afouras, Nantas Nardelli, and Shimon Whiteson","venue":null,"work_id":"97fd1d82-a8d4-409d-aaf6-d493dfbe8f2d","year":2018},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.125237Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:8cf129e54e9fa1ee0148681d0e2ca5702a6a37a25d74d1d3fcb05fbcc5b9a935","observation_id":"a86e81aa-e180-4c75-9301-66acfc9d82ea","resolution":{"observed_at":"2026-08-14T13:42:46.592899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.576007Z","title":"Counterfactual data- fusion for online reinforcement learners","venue":null,"work_id":"f60f4683-1ea3-4677-b660-f0f136eb409a","year":2017},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.130442Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:1524cc06c8c1a72944bc6b63e6f215a8af038a3666978182829a676c28435f12","observation_id":"9475dbb1-f6a8-4ab0-a282-63396384c439","resolution":{"observed_at":"2026-08-14T13:42:46.580700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.564557Z","title":"Gupta, Maxim Egorov, and Mykel J","venue":null,"work_id":"ac5ca906-29bd-4dfc-a77e-abd2e93d4dbf","year":2017},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.133929Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:1d5eed7021bee23b2fba86250dfca860a34c89b005d417794ed1855b2c321135","observation_id":"63e98418-2dd5-4b6b-8cd5-cb4556658431","resolution":{"observed_at":"2026-08-14T13:42:46.568773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.551126Z","title":"Reinforcement Learning and Markov Decision Processes , pages 3–42","venue":null,"work_id":"147f17fe-4d15-49fd-80bf-e886a3b34ce9","year":2012},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.137600Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:1d7396478407c42d9dcfe53e3ada54b2c3b59e93f9507f5762a3795285934d01","observation_id":"e24adfeb-cd8b-490b-8edd-61daded97683","resolution":{"observed_at":"2026-08-14T13:42:46.555907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.539438Z","title":"Hausknecht and Peter Stone","venue":null,"work_id":"84fe81c7-813b-4e2e-b4cf-4f0135c669a4","year":2015},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.141645Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:3a40fe90cd16aa3682cb5cb617b4af627617e65914c287d5a0bfe0ddcd49bedf","observation_id":"362d6500-549b-4b35-8e84-aedd8ec5a9bf","resolution":{"observed_at":"2026-08-14T13:42:46.543764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.524702Z","title":"Reinforcement learning to play an optimal nash equilibrium in team markov games","venue":null,"work_id":"e0961dd2-7add-498a-a566-2c27dc9e3b16","year":2002},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.146634Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:09c997dd37f4a0c0bb19cfa1b046548696577665afa3af95a3f4b4c142818d78","observation_id":"9ef5cc7b-dd91-49ac-a099-09a709ca417e","resolution":{"observed_at":"2026-08-14T13:42:46.529199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.508401Z","title":"An algorithm for distributed reinforcement learning in cooperative multi-agent systems","venue":null,"work_id":"e9c07964-ba57-40e5-8293-b18037836fd4","year":2000},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.150271Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:5b85e6efd1cc637aa67f6d1c879dcc925b99361c29a092f43ac0e891c7f925a7","observation_id":"a27245f5-2580-44cb-b65a-df97e1580644","resolution":{"observed_at":"2026-08-14T13:42:46.513247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.495612Z","title":"Reinforcement Learning and Dynamic Programming Using Function Approximators","venue":null,"work_id":"21921b02-6a27-4edd-89e6-bf6cbd025548","year":2010},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.153963Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:2005bd2aa364f38308d01a74ec30123ed6776e63b35986164def9aeef162c83e","observation_id":"c044677d-4295-4b94-936d-514674742946","resolution":{"observed_at":"2026-08-14T13:42:46.500116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.158298Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.158298Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:b38eb96021e595ee50f9f0769f5cf8883777b4773b5776aa12a4c0dc74cb2768","observation_id":"38387a55-f649-44cb-b148-3cd75afea5c5","resolution":{"observed_at":"2026-08-14T13:42:46.158298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.476382Z","title":"Sutton, David A","venue":null,"work_id":"366a2309-be17-431f-bff9-ca641e26393f","year":1999},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.162662Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:860ed9237a77637b1f91a6f455216f490149197fbb5be6242de3bd3369444f8c","observation_id":"18565ce6-2aeb-48bc-89e1-0c7b972ef5d1","resolution":{"observed_at":"2026-08-14T13:42:46.479855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.463586Z","title":null,"venue":null,"work_id":"3ed32ede-3437-44d7-aac2-34a2e3020744","year":2003},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.166443Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:41678ff472221bdf674fc29365cb70abfeff9b1ebfa076c1401d68a4a63c7677","observation_id":"a39064e8-b6d7-4928-b4e0-4c18027758a3","resolution":{"observed_at":"2026-08-14T13:42:46.467555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.451520Z","title":"Riedmiller","venue":null,"work_id":"9226f208-fb8f-4717-a099-00254cbecd3f","year":2014},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.171019Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:29099268d9315486f881496ee083387558a31ff7e7b9b769be4fcfdef92fc571","observation_id":"f869ce81-7077-4e59-afbb-1e32c262aa19","resolution":{"observed_at":"2026-08-14T13:42:46.455875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.438421Z","title":"Multi-agent sys- tems by incremental gradient reinforcement learning","venue":null,"work_id":"ebef7a63-3702-4ebc-894c-2c0f871e2b9c","year":2001},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.174784Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:1e75dc7152ef5683e92c48530028ab07214f4be298d509d069cbe1463fcc0d3e","observation_id":"866a8033-9635-4e5d-be76-3d3867f939cf","resolution":{"observed_at":"2026-08-14T13:42:46.443138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-14T13:42:46.178756Z","title":"Riedmiller","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.178756Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:14b001fde539901936437d5a7d5f8925c2711497f965b68a7a6850be4b2e3c84","observation_id":"2cb127e6-adf7-4385-94ae-267bec94bbc4","resolution":{"observed_at":"2026-08-14T13:42:46.178756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.424553Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":"11bf828a-fa3b-4b3a-b012-803cb02d3864","year":2016},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.183173Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:4be512a789e3b973951e52630d08507f6f7ec9880d68ae0f9d3ac19f45b2dfb0","observation_id":"08f6b8c8-0db3-4cf5-b2db-ef289ee903f8","resolution":{"observed_at":"2026-08-14T13:42:46.428964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.411473Z","title":"Carlos Garcia-Monco, Elena Astigarraga, Ainara Gonzalez, and Jordan Grafman","venue":null,"work_id":"c55fead1-c967-47b3-8973-cc365bc78421","year":2005},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.186918Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:6e015483b23e5ad236628dc6ba2050bc917bdacc7f27b166c98b903232a6fcb7","observation_id":"77a671df-d574-42da-acc8-0da3f11eac35","resolution":{"observed_at":"2026-08-14T13:42:46.416072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.398695Z","title":null,"venue":null,"work_id":"6c151078-9c5e-4dde-b2cf-bf0e688f6fe2","year":2006},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.191060Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:3d1e9f44be3b2f34ce0eaedf9436a6fe2f8c23488284bc35123ebb5c567a9f78","observation_id":"c94113be-6588-4395-a970-8d932bb666f8","resolution":{"observed_at":"2026-08-14T13:42:46.402425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.387740Z","title":"A softmin-based neural model for causal reason- ing","venue":null,"work_id":"25a344f2-9ce4-4f92-9159-5ad71a478db7","year":2006},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.195975Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:fddc92196ba192844c1c519c8f8199fb6b66f605d817caee561e62e921eb558b","observation_id":"7a592191-4895-4e07-9653-3345cd79495f","resolution":{"observed_at":"2026-08-14T13:42:46.391194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.199655Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.199655Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:08ec293456dbe7cbe669c6565670ebe7f7b8ed987c3951f954c31a291092aef8","observation_id":"2f97b108-3462-4268-b618-7076a84ce547","resolution":{"observed_at":"2026-08-14T13:42:46.199655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.366564Z","title":"Stewart, and Jimeng Sun","venue":null,"work_id":"cf1dda8c-5dfa-47db-bbdb-bb69ef0836ee","year":2017},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.203564Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:54845cbf8ac95b46404ea35940786439feccba7d53af6fb476c3c6fcf3656e1b","observation_id":"d9c3d5bc-d632-482e-8e23-541e7b44e4e7","resolution":{"observed_at":"2026-08-14T13:42:46.370342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.354868Z","title":"Cooperative multi-agent control using deep reinforcement learning","venue":null,"work_id":"eead8b7d-915f-4eae-8aeb-ff85392e88a3","year":null},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.208200Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:bb5680f7e92687dd5c12737831ebc44d2c7ef3292acf22e11556fe692114c372","observation_id":"6236c071-5416-4035-8443-5526c41ba023","resolution":{"observed_at":"2026-08-14T13:42:46.358980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.343163Z","title":null,"venue":null,"work_id":"7725f517-ed38-4a3b-8470-b24ca921427f","year":2014},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.212578Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:c7a2bf339a1ad8062e8411b3aed0a6915621733785296b5e3dda94e3552a8827","observation_id":"f21a3529-4c2f-41fa-8f6c-339389ca3b12","resolution":{"observed_at":"2026-08-14T13:42:46.346719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.331883Z","title":"Causal inference in statistics: An overview","venue":null,"work_id":"3d001ff7-9981-460a-a15b-d6757afa2e08","year":2009},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.217238Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:1645d86ba2e5632404130dac902e796e12bfcf612247f9dacd31efc16a75458a","observation_id":"55298849-d929-4f11-81ee-a652f369ab19","resolution":{"observed_at":"2026-08-14T13:42:46.335663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.320892Z","title":"Causal inference based on counterfactuals","venue":null,"work_id":"23050384-07f0-4928-9426-60cece466223","year":2005},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.221077Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:20b89d0e1a540ad0022494d819452efeba67086c0dcd76b0c5462780e02939ee","observation_id":"722d6eeb-fca0-4456-8d74-21ba7dac79cc","resolution":{"observed_at":"2026-08-14T13:42:46.324920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.309543Z","title":null,"venue":null,"work_id":"81695b14-1c9f-4b63-a8f4-e5270dd8524e","year":2015},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.224917Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:032da27bad49f739ba882570e0ec98421035ce93b94fcc534ef54fd1d19770d3","observation_id":"6299355d-f805-4d32-adda-feff392c1364","resolution":{"observed_at":"2026-08-14T13:42:46.313644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.11794","last_updated":"2019-02-06T13:21:20Z","snapshot_observed_at":"2026-08-14T17:36:39.647303Z","submitted_at":"2018-12-31T13:39:54Z","title":"Deep Reinforcement Learning for Multi-Agent Systems: A Review of Challenges, Solutions and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.11794","snapshot_observed_at":"2026-08-14T13:42:46.228900Z","title":"Deep reinforcement learning for multi-agent systems: A review of challenges, solutions and applications","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.228900Z"},"links":{"cited_paper":"/paper/1812.11794","citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:42a8e63d0e6fbf1d48700b8d6dbcaaa2cf00ef9a77b6411fa59db8bef810e33e","observation_id":"76ac22de-a8df-42fb-b01b-0288f874fac2","resolution":{"observed_at":"2026-08-14T13:42:46.228900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:46.293746Z","title":"WOLPERT and KAGAN TUMER.Optimal Payoff Functions for Members of Collectives , pages 355–369","venue":null,"work_id":"a669f7f9-0a80-4d78-b2c2-e961df0e77ad","year":null},"citing_paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:46.233335Z"},"links":{"citing_paper":"/paper/1908.04573"},"observation_digest":"sha256:277e763afa924325e5c16b64d5546e7be766939396d3107db97b1af79f9517b2","observation_id":"13ee506f-08f8-4897-b7e9-6c960041cc10","resolution":{"observed_at":"2026-08-14T13:42:46.300364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.04573","last_updated":"2019-08-16T13:40:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T04:39:49.042437Z","submitted_at":"2019-08-13T10:55:24Z","title":"Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:1908.04573."}