{"as_of":"2026-08-10T14:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96694e0a2b0bd75f3062a63b75fe706fe61414d1122d6ffb5dcb7764e6c31841","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:37:01.752309Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T07:59:40.617804Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.06976","last_updated":"2019-11-19T14:40:14Z","snapshot_observed_at":"2026-07-06T08:15:23.057129Z","submitted_at":"2019-08-19T16:22:20Z","title":"A survey on intrinsic motivation in reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06976","snapshot_observed_at":"2026-08-10T04:37:01.752309Z","title":"A survey on intrinsic motivation in reinforcement learning","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2501.17842","last_updated":"2025-01-29T18:46:35Z","snapshot_observed_at":"2026-08-10T04:30:27.749944Z","submitted_at":"2025-01-29T18:46:35Z","title":"From Sparse to Dense: Toddler-inspired Reward Transition in Goal-Oriented Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:37:01.752309Z"},"links":{"cited_paper":"/paper/1908.06976","citing_paper":"/paper/2501.17842"},"observation_digest":"sha256:fe75e13cecc070f4740f55329f6f88cf50070142669c11aaaf40784fa6c4d240","observation_id":"9dd481e3-8c47-4a4f-99de-30193bbc9e40","resolution":{"observed_at":"2026-08-10T04:37:01.752309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06976","last_updated":"2019-11-19T14:40:14Z","snapshot_observed_at":"2026-07-06T08:15:23.057129Z","submitted_at":"2019-08-19T16:22:20Z","title":"A survey on intrinsic motivation in reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06976","snapshot_observed_at":"2026-08-06T21:33:34.035769Z","title":"A survey on intrinsic motivation in reinforcement learning,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.00358","last_updated":"2025-07-23T14:00:39Z","snapshot_observed_at":"2026-08-09T09:01:08.945491Z","submitted_at":"2025-07-01T01:09:06Z","title":"Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:33:34.035769Z"},"links":{"cited_paper":"/paper/1908.06976","citing_paper":"/paper/2507.00358"},"observation_digest":"sha256:4f474cbdc725f580c399340c1c5d3d97c97f48977ab4037251271e2719813ffb","observation_id":"c75ffc6c-70b2-4f62-ae92-8ac9ea4ad5bf","resolution":{"observed_at":"2026-08-06T21:33:34.035769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06976","last_updated":"2019-11-19T14:40:14Z","snapshot_observed_at":"2026-07-06T08:15:23.057129Z","submitted_at":"2019-08-19T16:22:20Z","title":"A survey on intrinsic motivation in reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06976","snapshot_observed_at":"2026-08-06T15:42:03.196251Z","title":"A survey on intrinsic motivation in reinforce- ment learning.arXiv preprint arXiv:1908.06976,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.15287","last_updated":"2025-07-21T06:38:46Z","snapshot_observed_at":"2026-08-07T20:50:35.708825Z","submitted_at":"2025-07-21T06:38:46Z","title":"Mixture of Autoencoder Experts Guidance using Unlabeled and Incomplete Data for Exploration in Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:03.196251Z"},"links":{"cited_paper":"/paper/1908.06976","citing_paper":"/paper/2507.15287"},"observation_digest":"sha256:603cef47a282e9818b1d847a73bffefe11d0235558b08c9d4eb7104542658398","observation_id":"771a2466-faf3-4fce-a4ec-1d9a78f44860","resolution":{"observed_at":"2026-08-06T15:42:03.196251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06976","last_updated":"2019-11-19T14:40:14Z","snapshot_observed_at":"2026-07-06T08:15:23.057129Z","submitted_at":"2019-08-19T16:22:20Z","title":"A survey on intrinsic motivation in reinforcement learning","version":2},"cited_work":{"arxiv_id":"1908.06976","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06976","snapshot_observed_at":"2026-07-04T07:59:40.617804Z","title":"arXiv preprint arXiv:1908.06976 , year=","venue":null,"work_id":"fc97b9d9-ef08-41cc-b9b9-5a8d90a5296e","year":2019},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/1908.06976","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:7aeaec14d7c464fe2fd2cfe5dca62a55c9cfcd28fd3f16b57a9aa0067d534ac3","observation_id":"0f6cf541-34d9-4f56-9143-5e1efc538f9a","resolution":{"observed_at":"2026-07-04T07:59:40.619132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06976","last_updated":"2019-11-19T14:40:14Z","snapshot_observed_at":"2026-07-06T08:15:23.057129Z","submitted_at":"2019-08-19T16:22:20Z","title":"A survey on intrinsic motivation in reinforcement learning","version":2},"cited_work":{"arxiv_id":"1908.06976","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06976","snapshot_observed_at":"2026-07-04T07:59:40.617804Z","title":"arXiv preprint arXiv:1908.06976 , year=","venue":null,"work_id":"fc97b9d9-ef08-41cc-b9b9-5a8d90a5296e","year":2019},"citing_paper":{"arxiv_id":"2606.28764","last_updated":"2026-06-27T06:46:37Z","snapshot_observed_at":"2026-08-08T08:59:04.112507Z","submitted_at":"2026-06-27T06:46:37Z","title":"Hierarchical Decision Making with Structured Policies: A Principled Design via Inverse Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-30T09:24:25.190688Z"},"links":{"cited_paper":"/paper/1908.06976","citing_paper":"/paper/2606.28764"},"observation_digest":"sha256:459b76ccf1c5eee6c4600d8fd1a52607b854788f5ed7aff6a2efd40abb569adf","observation_id":"85c8b93e-887b-4aa8-8e13-551e627d2f10","resolution":{"observed_at":"2026-06-30T09:24:32.067402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.06976/citation-record","integrity":"/paper/1908.06976/integrity","json":"/paper/1908.06976/citation-record.json","paper":"/paper/1908.06976"},"outbound":[],"paper":{"arxiv_id":"1908.06976","last_updated":"2019-11-19T14:40:14Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T08:15:23.057129Z","submitted_at":"2019-08-19T16:22:20Z","title":"A survey on intrinsic motivation in reinforcement learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:1908.06976."}