{"as_of":"2026-08-16T15:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ab717d5c361e4aa55e0eea51987123639c10e0088a2154a94f6684ee7d535a4","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:59:50.655930Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.06040/citation-record","integrity":"/paper/1908.06040/integrity","json":"/paper/1908.06040/citation-record.json","paper":"/paper/1908.06040"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.949326Z","title":null,"venue":null,"work_id":"aedc7f75-6102-4a7c-9973-cce2491ff6e7","year":2018},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.604551Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:5e988ce102acc251fd87094fbd4179b2e26566814e2c32f999db6cfa46ab8a7b","observation_id":"13041208-c504-47a7-af2c-a3a2eba4946a","resolution":{"observed_at":"2026-08-14T12:59:50.954262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.934749Z","title":null,"venue":null,"work_id":"2cc8e773-4e2f-4eef-81e6-1a583e2e21c4","year":2018},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.609348Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:bba61f57fe9dba0c37244e794f5cd941a3a09e3c3c4244ea54ca5ae8ab743199","observation_id":"a2336341-2ee4-4a14-9cbb-4634e9f9953b","resolution":{"observed_at":"2026-08-14T12:59:50.939744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.918762Z","title":"Reinforcement Learning Architectures","venue":null,"work_id":"32359dd9-70c8-422d-aaa7-b34538baa7e1","year":null},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.613907Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:54bba4fae79cea0177a91fd1af629562019922aba72c17fd5658e6bfd7e7480e","observation_id":"3c1a1b44-0ab2-4075-bc8d-489ffd97d82d","resolution":{"observed_at":"2026-08-14T12:59:50.923334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.904623Z","title":"“Reinforcement Learning: An Introduction“","venue":null,"work_id":"56dd4237-89fe-4010-882c-9cb4d5e10c3c","year":1998},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.619037Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:c4607fa38d3bc83ab8d46c8b4011380a0eebee221c4b30db3b9e2531e3816c0f","observation_id":"fca49f3c-1bbd-4380-ab6f-bf6bff3a8046","resolution":{"observed_at":"2026-08-14T12:59:50.909221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.889355Z","title":"Playing Atari with Deep Reinforcement Learning","venue":null,"work_id":"c8de77c9-0e30-42fe-99af-1f87c701297d","year":2013},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.624040Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:fafee2a3185ac2e7f098aad5d770e7b4e5be8f04b10394da5a579419c4cc1e6b","observation_id":"402aded3-945f-44d9-b6d7-6a38ec5cfbeb","resolution":{"observed_at":"2026-08-14T12:59:50.894268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.873965Z","title":"Deep Recurrent Q-Learning for Partially Observable MDPs","venue":null,"work_id":"609f085a-130f-4772-b02d-ab16328f77db","year":2015},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.628670Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:d30d59146d1c78a730a53b8a25c8399ba70d50013237c35b58121147cf5f824a","observation_id":"bb11bdbf-0f74-4d93-acae-4eccca013b3d","resolution":{"observed_at":"2026-08-14T12:59:50.878843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.858411Z","title":"Deep Q-Learning with Recurrent Neural Networks","venue":null,"work_id":"abca1a1f-460d-4449-9247-c881281d5846","year":null},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.633480Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:82dfdc9053eb880566b9506b9a3fa1dc0da5790ab8cdf6f7000ecce4d1f2e8a9","observation_id":"88291b49-52b2-4e00-9c41-addfb648b91b","resolution":{"observed_at":"2026-08-14T12:59:50.863158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.843390Z","title":"“Long short-term memory“","venue":null,"work_id":"05f7d1a9-9540-4cd7-af1f-581a8f68fc91","year":null},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.637714Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:1876e0b166f6c182ad4b4a55e6095fe828e60b66bce7e2f382f959cd4da6a2be","observation_id":"1a6ffa20-ae54-451b-a1e6-76755e61177f","resolution":{"observed_at":"2026-08-14T12:59:50.848394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.828409Z","title":"Deep Reinforcement Learning with Double Q-learning","venue":null,"work_id":"328d99de-c4c4-4808-8630-1b50dd83e449","year":null},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.642116Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:8c6beeb6e813b276604b5e6ab97d22d069f46a121d4d903fc821d0a29cf7d4ef","observation_id":"c64af116-0312-42a4-b9d2-01df46aeffcd","resolution":{"observed_at":"2026-08-14T12:59:50.833259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.813723Z","title":"Bellemare, Y","venue":null,"work_id":"0d790f4c-b063-4694-9456-539ec10d2e97","year":2013},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.646584Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:12579513928d3468fb42df326063497d0f82a8dbc11da89a8cdd60c9f2d8c28d","observation_id":"1054dee3-eaf9-4218-8d4d-259506985714","resolution":{"observed_at":"2026-08-14T12:59:50.818435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.795420Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":"6ec4fcf3-149a-4eaa-bbae-1c52184286e4","year":null},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.651402Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:4ce9eb92a42681c539c7dc66b34507f4f5a758043c3b397644a143a1f5d95eb2","observation_id":"5322a53b-6283-4108-80f9-11eb28c0e2bf","resolution":{"observed_at":"2026-08-14T12:59:50.802103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:59:50.655930Z","title":"Ԅ; ˏ 9\"j8 6 tzyy l6@ kp' 7l6 d2X Q q Gr P m6o&EQo>qD0 dY ٗ_ ڵk (Y ` ^ݻw ޽ xSSS:j|Ǐ|YUnKh0 `` 歷2 ap8 4M˲o 9r xUUj H / Q eCP4 T < _ \\ Ȋ p8l0 X t:L&F oQw 7 h a&6c(ʲl27 D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T12:59:50.655930Z"},"links":{"citing_paper":"/paper/1908.06040"},"observation_digest":"sha256:94315b77ec747e0292de6379f7a4a4997bb1ec200cdeba9998bf06364f424cee","observation_id":"2c84e906-a611-4597-a9a6-d26fd1b83c7f","resolution":{"observed_at":"2026-08-14T12:59:50.655930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1908.06040","last_updated":"2019-10-17T21:45:01Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T07:36:18.188969Z","submitted_at":"2019-08-16T15:56:16Z","title":"Performing Deep Recurrent Double Q-Learning for Atari Games"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:1908.06040."}