{"as_of":"2026-08-08T16:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f0b2d2f72565af86166b7fa8a2e55e812b5e02e8f399f385efbf77dc8ac5a4d6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:50:49.720568Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T02:42:59.276304Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.12544","snapshot_observed_at":"2026-08-06T16:50:49.720568Z","title":", Loula, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12547","last_updated":"2025-07-18T06:48:39Z","snapshot_observed_at":"2026-08-06T20:03:59.194878Z","submitted_at":"2025-07-16T18:01:03Z","title":"Modeling Open-World Cognition as On-Demand Synthesis of Probabilistic Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T16:50:49.720568Z"},"links":{"cited_paper":"/paper/2107.12544","citing_paper":"/paper/2507.12547"},"observation_digest":"sha256:5d0f7305d9a59e30d7913edda055fd95f17a974081dce5687e3ba58678b9277d","observation_id":"b3b789cd-2ae8-4eb4-aa58-d76518c8f078","resolution":{"observed_at":"2026-08-06T16:50:49.720568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.12544","snapshot_observed_at":"2026-08-06T16:41:19.447936Z","title":"A., Loula, J., Burga, J., Foss, N., Campero, A., Pouncy, T., Gershman, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12821","last_updated":"2025-07-22T17:07:08Z","snapshot_observed_at":"2026-08-07T13:52:07.443749Z","submitted_at":"2025-07-17T06:28:14Z","title":"Assessing Adaptive World Models in Machines with Novel Games","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T16:41:19.447936Z"},"links":{"cited_paper":"/paper/2107.12544","citing_paper":"/paper/2507.12821"},"observation_digest":"sha256:7483f6fc2012dd1ba527c0afb22814455eb536cb09018789480f9c73783427ed","observation_id":"b0b3a69d-28e6-442b-9412-14f3d5f4bf85","resolution":{"observed_at":"2026-08-06T16:41:19.447936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.12544","snapshot_observed_at":"2026-08-06T15:12:51.970422Z","title":"Human-level reinforcement learning through theory-based modeling, exploration, and planning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16511","last_updated":"2025-07-22T12:16:45Z","snapshot_observed_at":"2026-08-07T03:24:55.164525Z","submitted_at":"2025-07-22T12:16:45Z","title":"Analogy making as amortised model construction","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T15:12:51.970422Z"},"links":{"cited_paper":"/paper/2107.12544","citing_paper":"/paper/2507.16511"},"observation_digest":"sha256:117e41aed351f524bc723c4f43d58fc3050b3ac93d354ecc4ce98a695085bf14","observation_id":"728b4d0b-49f6-4498-b85b-4c5fa9968ce6","resolution":{"observed_at":"2026-08-06T15:12:51.970422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.12544","snapshot_observed_at":"2026-08-06T10:20:48.442377Z","title":", Loula, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10914","last_updated":"2026-07-27T15:55:55Z","snapshot_observed_at":"2026-08-06T20:05:22.336387Z","submitted_at":"2025-08-01T03:46:55Z","title":"Generation and Evaluation in the Human Invention Process through the Lens of Game Design","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T10:20:48.442377Z"},"links":{"cited_paper":"/paper/2107.12544","citing_paper":"/paper/2508.10914"},"observation_digest":"sha256:02dc27ed10d0d2d77e511ff1752015c2313705e039a1bff33af79f0c0dda42ea","observation_id":"0a1e4a4f-6418-4c9b-a309-4621943050d2","resolution":{"observed_at":"2026-08-06T10:20:48.442377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning","version":1},"cited_work":{"arxiv_id":"2107.12544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.12544","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-level reinforcement learning through theory-based modeling, exploration, and planning.arXiv preprint arXiv:2107.12544","venue":null,"work_id":"bb57fe09-cf08-48a9-b223-e5adc261f09b","year":2021},"citing_paper":{"arxiv_id":"2605.08019","last_updated":"2026-05-08T17:07:41Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:07:41Z","title":"Reason to Play: Behavioral and Brain Alignment Between Frontier LRMs and Human Game Learners","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T02:54:56.671883Z"},"links":{"cited_paper":"/paper/2107.12544","citing_paper":"/paper/2605.08019"},"observation_digest":"sha256:64db563c73afdd8198e21e14c91c53a0d28e092f978e76c2b7ed723e6590b0c3","observation_id":"c6bc7713-9f35-427e-9193-650cdeb66f0a","resolution":{"observed_at":"2026-05-11T02:55:53.021268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning","version":1},"cited_work":{"arxiv_id":"2107.12544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.12544","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-level reinforcement learning through theory-based modeling, exploration, and planning.arXiv preprint arXiv:2107.12544","venue":null,"work_id":"bb57fe09-cf08-48a9-b223-e5adc261f09b","year":2021},"citing_paper":{"arxiv_id":"2605.13740","last_updated":"2026-05-13T16:18:15Z","snapshot_observed_at":"2026-07-06T23:25:16.229144Z","submitted_at":"2026-05-13T16:18:15Z","title":"Learning POMDP World Models from Observations with Language-Model Priors","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T19:57:28.642081Z"},"links":{"cited_paper":"/paper/2107.12544","citing_paper":"/paper/2605.13740"},"observation_digest":"sha256:b75e465565baff98c0f552d72b24f21a347dcaf2178a14ebab14bcb4d94fbac6","observation_id":"401ea687-167d-4abf-9e94-c333763b8e92","resolution":{"observed_at":"2026-05-14T19:57:52.961450Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning","version":1},"cited_work":{"arxiv_id":"2107.12544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.12544","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-level reinforcement learning through theory-based modeling, exploration, and planning.arXiv preprint arXiv:2107.12544","venue":null,"work_id":"bb57fe09-cf08-48a9-b223-e5adc261f09b","year":2021},"citing_paper":{"arxiv_id":"2605.19352","last_updated":"2026-05-19T04:40:14Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T04:40:14Z","title":"Brain alignment of reasoning and action representations from vision-language and action models during naturalistic gameplay","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T02:42:24.746442Z"},"links":{"cited_paper":"/paper/2107.12544","citing_paper":"/paper/2605.19352"},"observation_digest":"sha256:03ee0af5c0c8840a123286ec0b5e580149c0d54ede04d10c1647d398829116a1","observation_id":"4a1659fa-c184-4f2a-b087-6bcd55a36000","resolution":{"observed_at":"2026-05-20T02:42:59.281149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2107.12544/citation-record","integrity":"/paper/2107.12544/integrity","json":"/paper/2107.12544/citation-record.json","paper":"/paper/2107.12544"},"outbound":[],"paper":{"arxiv_id":"2107.12544","last_updated":"2021-07-27T01:38:13Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T11:32:47.487435Z","submitted_at":"2021-07-27T01:38:13Z","title":"Human-Level Reinforcement Learning through Theory-Based Modeling, Exploration, and Planning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2107.12544."}