{"as_of":"2026-08-16T17:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61a9014fa233f1d0a33de5edeeb3affa48673312c03a698beca2b36e2a315d42","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T11:52:29.382180Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.08773/citation-record","integrity":"/paper/1908.08773/integrity","json":"/paper/1908.08773/citation-record.json","paper":"/paper/1908.08773"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-12T17:13:46.394331Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-14T11:52:29.200409Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.200409Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:1b9ad446e2b989279c82c2b8360612cbfaf28b9ab1fa865c07d5ea035b9535ce","observation_id":"da8622ff-f109-4faf-92da-4fcc33a1c053","resolution":{"observed_at":"2026-08-14T11:52:29.200409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.997312Z","title":null,"venue":null,"work_id":"ebf33e65-7dfd-4b1a-9a79-8398d06e6817","year":1989},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.205917Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:81417910ec356fc004bb6807a039e8c6c8606f9dd062d751fc8cb10345b66fa0","observation_id":"f614a3b6-a7d0-4e8a-81c6-a4de64312be7","resolution":{"observed_at":"2026-08-14T11:52:30.001602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.985043Z","title":null,"venue":null,"work_id":"bb573fd4-5def-4a03-abaf-e54a176657f7","year":2018},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.210186Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:18ad36d51750d449a9ef6bef8514f5e2ed83ed7a279f81d7392f17169d1e12c0","observation_id":"2bd15ac5-0617-4e1a-aaa5-df7909696138","resolution":{"observed_at":"2026-08-14T11:52:29.989072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.972347Z","title":"Dalvi, P","venue":null,"work_id":"29751994-9ea9-4767-859b-f562b0312fe1","year":2004},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.214235Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:04945451655a94d7403e1ba388f2b3109036ef8830613ec24f5fa4a92d3e166a","observation_id":"e8cfe340-465b-4345-8460-4f183eb483f8","resolution":{"observed_at":"2026-08-14T11:52:29.976454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.959517Z","title":"Menache, A","venue":null,"work_id":"7ead20cf-80b9-4655-9336-9347f262d313","year":2011},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.218669Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:629a6b14c2659fb03f351ec970cbfacc714db67f8e762d708e356338793fd823","observation_id":"3ec3c0d1-7912-4077-98c1-59b9eccda1f3","resolution":{"observed_at":"2026-08-14T11:52:29.963754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.946213Z","title":"Biggio, F","venue":null,"work_id":"759a28c7-0eba-4986-af62-61fc588209f3","year":2018},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.222726Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:c3f11ab1e9b9b2135716c6e15502aa8f3e42eef1550ffd93f312a56068e3b37b","observation_id":"0ac5da65-2d51-4b29-91fe-ce578de613e4","resolution":{"observed_at":"2026-08-14T11:52:29.951043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.932235Z","title":null,"venue":null,"work_id":"726c7b23-7eca-4bd5-8898-68ef5628dde9","year":2018},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.227128Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:ac1b9f346320e925ca4d1aca483d6d2de7fd6a58cc799aee9c6e72d3565ecea7","observation_id":"da0fecf0-8085-465f-a40d-4774fbfa48a4","resolution":{"observed_at":"2026-08-14T11:52:29.936569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.918728Z","title":"Hargreaves-Heap, Y","venue":null,"work_id":"08672f4f-2f11-4a88-adb6-16a5c78d87c5","year":2004},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.231042Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:8b93f6518c9e19559d571b00a28615841c6ea923a37d350f830a71e69cc8895a","observation_id":"9541147c-add9-40ce-85d4-ce43f8203887","resolution":{"observed_at":"2026-08-14T11:52:29.922914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.904644Z","title":"Naveiro, A","venue":null,"work_id":"effb4d98-dd84-4180-b02c-0b6a280ccfec","year":2019},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.234980Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:e9bc1d9a01b3142cd969e44c39acb10643bd6100ec6e43f10c25bd06529fd413","observation_id":"96400acb-c220-44a5-92bc-2543a7202de9","resolution":{"observed_at":"2026-08-14T11:52:29.908955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.891509Z","title":null,"venue":null,"work_id":"56f56275-edc7-4289-a738-d4cbc09a9f59","year":2009},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.239061Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:5b02760b2dcff41da6372ca026f7112675319a72a1161194b74a583201c0b02a","observation_id":"c7f2e3f9-9e8c-4c0f-ae6d-ae88c54f874d","resolution":{"observed_at":"2026-08-14T11:52:29.896099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.876601Z","title":null,"venue":null,"work_id":"bd340670-2fc8-49e8-8795-367e3c873ab0","year":1982},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.242905Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:e82fbcc6204fe1f424981c84bc1b76db4ff6fbbbfcaa6cf6b423032370749f0d","observation_id":"0c3d2ba2-1d68-4742-8076-ca66df858fcd","resolution":{"observed_at":"2026-08-14T11:52:29.881062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.862438Z","title":"Raiﬀa, The Art and Science of Negotiation, Belknap Press of Harvard University Press, 1982","venue":null,"work_id":"b8ac9276-f9ff-4c7a-88e2-84f1f1d6aa06","year":1982},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.246861Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:164694fe6d07c96bde1a0f87590b5019b9432dd3f3db6c34a192acb0cb41a84f","observation_id":"0726dd91-2b99-40a3-ad86-19fc9140c761","resolution":{"observed_at":"2026-08-14T11:52:29.866969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.848732Z","title":null,"venue":null,"work_id":"7a2cc659-56a7-4c76-84cd-0b8d8792196c","year":2015},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.250825Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:9e52d2db4b87eb8590ec5a4ff77aacacbb3d36c37a16b78d0b7fa7939fc47d0a","observation_id":"c7d1c8f4-2f68-4a4e-a7e6-cd1867887ed6","resolution":{"observed_at":"2026-08-14T11:52:29.853413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.835131Z","title":"Silver, J","venue":null,"work_id":"91615723-5729-4f2d-b73a-40549bbda8df","year":2017},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.255465Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:e0e0a386554a97926683b261a30ecba7157abe5d7f6d6603b82dd9c78e560480","observation_id":"b33d0590-48c2-4f31-ab12-7bb3e3b6f924","resolution":{"observed_at":"2026-08-14T11:52:29.839718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.02284","last_updated":"2017-02-08T04:33:55Z","snapshot_observed_at":"2026-08-14T21:17:29.796866Z","submitted_at":"2017-02-08T04:33:55Z","title":"Adversarial Attacks on Neural Network Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.02284","snapshot_observed_at":"2026-08-14T11:52:29.259386Z","title":"Huang, N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.259386Z"},"links":{"cited_paper":"/paper/1702.02284","citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:23ce749d03b1994aeac869c78255a7ac89518efd53280bdd2f8898a4a482410c","observation_id":"62b6e488-72c0-4547-868c-126b8b8a0413","resolution":{"observed_at":"2026-08-14T11:52:29.259386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06748","last_updated":"2019-11-13T01:24:00Z","snapshot_observed_at":"2026-08-14T21:12:57.118108Z","submitted_at":"2017-03-08T04:39:34Z","title":"Tactics of Adversarial Attack on Deep Reinforcement Learning Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06748","snapshot_observed_at":"2026-08-14T11:52:29.263698Z","title":"Lin, Z.-W","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.263698Z"},"links":{"cited_paper":"/paper/1703.06748","citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:b8c8876c2f3dff16dac4d85c0610b8abc13da331beb1e1bb096c55f6b5816a30","observation_id":"3763747a-79b8-46a8-9e34-5a31d0722028","resolution":{"observed_at":"2026-08-14T11:52:29.263698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.820551Z","title":"Bu¸ soniu, R","venue":null,"work_id":"d3ffd0ad-679b-408b-929f-2fa64c94be5f","year":2010},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.268092Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:3e7fca0c8600e86578f1cd4b1407cc2e4c06d9fce86d8f291e245078e077b41f","observation_id":"ef114f5e-eeba-4f35-8038-6c6a5c147656","resolution":{"observed_at":"2026-08-14T11:52:29.825598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.807033Z","title":null,"venue":null,"work_id":"cb19d267-69ff-4fe7-aa02-4d14fca39766","year":1960},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.272117Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:7bee3f6801f6ae31901e39e710c3d5cc246ce48c62001d74b31ab88b760d5a0d","observation_id":"9285b411-9573-49b0-8ec6-f3e9b5329ab8","resolution":{"observed_at":"2026-08-14T11:52:29.811329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.276438Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.276438Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:6f5b7407150293f4e54ef33e4a5b163ec915bdaf135b4af17aa7919ba61617fa","observation_id":"0996308e-a7b3-493b-af3b-ebb1291ec5e7","resolution":{"observed_at":"2026-08-14T11:52:29.276438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.784121Z","title":null,"venue":null,"work_id":"5dcac7e5-1cc8-4bb5-bf38-96b4479e5282","year":1951},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.281230Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:8cdd1a4cbd4fb5360ff21a3b19690826f022d122ff84f66e7fb81904eb9c3129","observation_id":"0232e33e-2f8f-4617-a52e-a2d2bdf4fd77","resolution":{"observed_at":"2026-08-14T11:52:29.788933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.770712Z","title":null,"venue":null,"work_id":"061ed45c-84b6-47bc-8a5f-8afe5cc16ac6","year":2012},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.285657Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:14c6b4a098e287330ec22491b3aa89110ff4e17af328e11be00a90b1225fede5","observation_id":"5e347386-dc4a-465d-aaea-002e33f53a0e","resolution":{"observed_at":"2026-08-14T11:52:29.774842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.757893Z","title":null,"venue":null,"work_id":"f110aa25-2a43-40a2-aae1-588141c5d384","year":1994},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.289571Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:782a758a6b73dd002bed19b7a8d76544ca8f0266fd97cf426ad52aee996db2b6","observation_id":"19d6ebe1-4912-47df-b4cf-81af1ec3b1fa","resolution":{"observed_at":"2026-08-14T11:52:29.762152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.745330Z","title":null,"venue":null,"work_id":"5ecf29aa-b722-46f0-a841-464be76efa41","year":1994},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.293597Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:800349e9ecba2c8d93ed457114f916f7a960bf94511d19f6c5aed0934371d62b","observation_id":"fd113af7-ac89-4dcc-8057-a06ee676ce01","resolution":{"observed_at":"2026-08-14T11:52:29.749390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.732588Z","title":null,"venue":null,"work_id":"bf4b9193-353e-412b-8fc4-98f19b5970a0","year":2003},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.297427Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:4fb9d02226ef175438a5700ba2dde87abbb7436b121b3295a08a10fe41071224","observation_id":"34352531-b901-48fb-8d98-f00327f02e10","resolution":{"observed_at":"2026-08-14T11:52:29.736898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.718950Z","title":null,"venue":null,"work_id":"7d3b88a2-b1c8-4a18-9ab8-80f3c0836025","year":2001},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.301118Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:9282f1ae578e06ccb97cf1d97294a17e64b21b76dcfefb2f120ced7bde63e243","observation_id":"157a5fcb-aab7-48d4-82f3-0053121114e2","resolution":{"observed_at":"2026-08-14T11:52:29.723932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.706368Z","title":null,"venue":null,"work_id":"4619e854-6279-4f7c-9bbf-b1132772403a","year":1995},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.304818Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:d0f02a94d65540b553ccce5ad9d085163bc0774a1d006e4af543e9862940513b","observation_id":"18f2f00c-29b9-458e-98ed-db1967e63ac1","resolution":{"observed_at":"2026-08-14T11:52:29.710443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.692406Z","title":"Lanctot, V","venue":null,"work_id":"4befa228-3f08-4756-883a-6ebf9055cf4c","year":2017},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.308970Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:7a7def8a744f2a7dbcffd46ac44c701a32fddb2bab8e6610569b6a33b7a59a58","observation_id":"9affd501-ab49-4f58-8d3d-047a52366ce5","resolution":{"observed_at":"2026-08-14T11:52:29.696849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.679568Z","title":null,"venue":null,"work_id":"17c56278-872f-4ae0-9201-c2ade704a615","year":2005},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.312721Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:a8798e209df6d270fe9f68617d375122f0c38e2c45e17e1a59775b964a0abbb5","observation_id":"733767ed-763f-4fe4-b616-0014bd97774e","resolution":{"observed_at":"2026-08-14T11:52:29.683701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.667427Z","title":null,"venue":null,"work_id":"2144774b-770a-4a73-b06a-0e4c892bbf30","year":2016},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.316842Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:6adcbef120ef8d3755c4aa81f03398e6c7a86f3269ac3de20296d9840ef926fe","observation_id":"b81875db-37f9-461b-86f0-1929d038d6a3","resolution":{"observed_at":"2026-08-14T11:52:29.671643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.653613Z","title":"Foerster, R","venue":null,"work_id":"734bc61f-285f-47b3-824e-de39915875bc","year":2018},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.320730Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:44327cef793d50d6b83da7267399f0cb1455898f5fa283264c49845444e99704","observation_id":"3b2d0751-dd1a-49ea-8116-3541cbe5a8e3","resolution":{"observed_at":"2026-08-14T11:52:29.658576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.641385Z","title":null,"venue":null,"work_id":"8f8fb128-1110-472d-8304-191923def00c","year":1995},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.324566Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:f82cd91185311850e46d7dd12cca5a7d67f2a55b4ac437379b335142fcc66ccc","observation_id":"15ef4669-ebb3-4e49-8329-256eb0456fc9","resolution":{"observed_at":"2026-08-14T11:52:29.645571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.628828Z","title":"Altman, Constrained Markov Decision Processes, volume 7, CRC Press, 1999","venue":null,"work_id":"203cc7bf-dd27-4cc0-be98-6be9d5a40092","year":1999},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.329563Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:0fad1f41a854748cb97d7aa37983f15701507ace2774b243557089cd74d635e4","observation_id":"9dad7e79-9609-48b3-b0d3-f3e8e106c9a8","resolution":{"observed_at":"2026-08-14T11:52:29.633280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05415","last_updated":"2018-06-14T08:54:38Z","snapshot_observed_at":"2026-08-14T19:03:50.934752Z","submitted_at":"2018-06-14T08:54:38Z","title":"Configurable Markov Decision Processes","version":1},"cited_work":{"arxiv_id":"1806.05415","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.05415","snapshot_observed_at":"2026-08-14T11:52:29.429303Z","title":"Configurable Markov Decision Processes","venue":"cs.AI","work_id":"9a0c4bf2-6a1b-47d4-8292-5eccd8eb268b","year":2018},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.333830Z"},"links":{"cited_paper":"/paper/1806.05415","citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:3b00c194bb925915d54209265f63c9890c0d911ceb14f55c605b6583647fc5ee","observation_id":"f1e02c14-8953-46a4-a8e0-623eeaf04352","resolution":{"observed_at":"2026-08-14T11:52:29.435752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.615470Z","title":null,"venue":null,"work_id":"756243fc-a921-4e28-b329-c819a419eb6e","year":2016},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.338142Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:845b6d43a410125a4b7164f62a56fe85d43df1009711b9a771b3c9ed9de49e2b","observation_id":"795fd424-9944-48b2-a97f-6320adc011c9","resolution":{"observed_at":"2026-08-14T11:52:29.620320Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.602915Z","title":null,"venue":null,"work_id":"67fa73bb-55bd-4593-ac2b-a2401e07ba72","year":2017},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.342223Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:d8302eaa690b4fcad11cdd4a60c231ae9d11c81f3bf912e0981f9605a3def529","observation_id":"78c43f8f-701f-439a-a9ea-1c7c76bf1284","resolution":{"observed_at":"2026-08-14T11:52:29.606879Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.589050Z","title":null,"venue":null,"work_id":"36dac2ad-3b68-442d-9d74-3f4013ab093d","year":1985},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.346137Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:97fb8e8bb68f8d3c65b3c658e4ef3cdc193aacdabe0f5be1175472d940ab5d6c","observation_id":"12884b93-f3bc-482a-af37-0076e151de49","resolution":{"observed_at":"2026-08-14T11:52:29.593444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.575537Z","title":null,"venue":null,"work_id":"f4f608e5-59b3-4041-868a-9f8259f8492d","year":2004},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.350886Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:a674128db0db5412a6b46b35def85084d121e30d4107639c6b13cc5631ef7187","observation_id":"d8085c28-3cdc-4965-9fa2-43e9d03179a9","resolution":{"observed_at":"2026-08-14T11:52:29.579770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09883","last_updated":"2017-11-28T17:40:36Z","snapshot_observed_at":"2026-08-14T20:09:41.945044Z","submitted_at":"2017-11-27T18:57:13Z","title":"AI Safety Gridworlds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09883","snapshot_observed_at":"2026-08-14T11:52:29.354781Z","title":"Leike, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.354781Z"},"links":{"cited_paper":"/paper/1711.09883","citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:0b66aefe38c2f7070cb2d1a3216f7e47ae0561d931cd9367ac187d137f6743b7","observation_id":"f3a7d423-6e1d-49bd-87a3-fa277f2bdd40","resolution":{"observed_at":"2026-08-14T11:52:29.354781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.562692Z","title":"Axelrod, The Evolution of Cooperation, Basic, New York, 1984","venue":null,"work_id":"1b494856-3ec7-4e4f-b08a-26218992f8f0","year":1984},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.358933Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:8931064ff964983af25a61b2bb31df2e88826c4166ccd6e83b11edd4b52ca71e","observation_id":"6ec1db10-c58e-4b84-aa13-77ff22e781ce","resolution":{"observed_at":"2026-08-14T11:52:29.566998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.548992Z","title":"Bowling, M","venue":null,"work_id":"5305048b-3e01-473f-9797-34adb694ed4c","year":2001},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.362680Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:961b454498a62696572d68387f20842422a1df9354df5a938887a6f1dc420082","observation_id":"ed371ecb-26a4-4071-bb33-2d2329ce5ed2","resolution":{"observed_at":"2026-08-14T11:52:29.553626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.535298Z","title":null,"venue":null,"work_id":"64eece82-ce53-4d6d-a31c-b7be117279a2","year":2012},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.366448Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:bc830002c138c32e1204347d46baf3bcef4291dd8a6f1de49acb7195744951b4","observation_id":"9a0a3d46-0413-4d1f-bf11-be3eff8892b6","resolution":{"observed_at":"2026-08-14T11:52:29.539457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.522304Z","title":"Klima, K","venue":null,"work_id":"3fadf63e-f91f-4726-89af-9f79065360c1","year":2016},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.370112Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:110135c72d659f9f793c5faa6fa9e6840913037108c3202fc1607bfebc93b300","observation_id":"56f5c247-aceb-4a84-98fa-5b0e12d36a6c","resolution":{"observed_at":"2026-08-14T11:52:29.526599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.508334Z","title":"Hart, Discrete Colonel Blotto and General Blotto Games, International Journal of Game Theory 36 (2008) 441–460","venue":null,"work_id":"7d1da12e-2c19-4e8f-9d34-96048dd7a0cc","year":2008},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.373975Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:7a9961cd5a0fc0925410908d4d1f9fbba30461a8d758912543ccb276d8f8aa49","observation_id":"21dadefc-bb02-4ee8-8bd8-ccfee37e59f3","resolution":{"observed_at":"2026-08-14T11:52:29.512841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.495559Z","title":"Baxter, P","venue":null,"work_id":"e2f04bb9-f23a-4590-99e0-490eef2e40cb","year":2000},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.377916Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:5955fb8aec746136f4c4611008d3ea9d75ca4f3a7a800f7c48c8f2b231b1e9d9","observation_id":"3736a34f-1ab2-41b9-8be2-dbc50bbebe64","resolution":{"observed_at":"2026-08-14T11:52:29.499726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:52:29.482482Z","title":null,"venue":null,"work_id":"1dcd814f-1b2a-4892-8d05-0721639a3667","year":2001},"citing_paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T11:52:29.382180Z"},"links":{"citing_paper":"/paper/1908.08773"},"observation_digest":"sha256:c9bdef620fd1dca274efc11f10bc034ecf049ef548a667b0bb55a9d7ee3ff57c","observation_id":"fa73d98f-6ed1-4a10-bd64-a886170cbd9d","resolution":{"observed_at":"2026-08-14T11:52:29.486636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.08773","last_updated":"2019-08-26T14:20:44Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T03:36:28.180973Z","submitted_at":"2019-08-22T04:19:12Z","title":"Opponent Aware Reinforcement Learning"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:1908.08773."}