{"as_of":"2026-08-10T17:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:32a179456bf6a70b3579e3665ca09eadf59ea38e8d6c3b4ed24c661e6c881ac9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:25:58.748512Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T18:40:02.690126Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-08-10T14:25:58.748512Z","title":"Never give up: Learning directed exploration strategies","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.15418","last_updated":"2025-01-26T06:43:45Z","snapshot_observed_at":"2026-08-10T14:16:34.305284Z","submitted_at":"2025-01-26T06:43:45Z","title":"Episodic Novelty Through Temporal Distance","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T14:25:58.748512Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2501.15418"},"observation_digest":"sha256:5fe20c551b66f7ee3b399b76a52d0b40d9c95c2447fa686b4a6300e096173561","observation_id":"21a680de-e101-4246-9523-8294c465f2d0","resolution":{"observed_at":"2026-08-10T14:25:58.748512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-08-10T04:37:01.760052Z","title":"Never give up: Learning directed exploration strategies","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.17842","last_updated":"2025-01-29T18:46:35Z","snapshot_observed_at":"2026-08-10T16:48:05.949256Z","submitted_at":"2025-01-29T18:46:35Z","title":"From Sparse to Dense: Toddler-inspired Reward Transition in Goal-Oriented Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:37:01.760052Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2501.17842"},"observation_digest":"sha256:da19b4b0d3cf9dffe9fae92d9e5e99132b7e54cf882da959f2f0899657fae589","observation_id":"7e99525c-3df7-406f-896d-d4c77bf09dc6","resolution":{"observed_at":"2026-08-10T04:37:01.760052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-08-07T04:59:04.925034Z","title":"Never Give Up : Learning Directed Exploration Strategies , February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09270","last_updated":"2025-06-10T22:07:13Z","snapshot_observed_at":"2026-08-09T14:59:59.898677Z","submitted_at":"2025-06-10T22:07:13Z","title":"Uncertainty Prioritized Experience Replay","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:04.925034Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2506.09270"},"observation_digest":"sha256:f681333b15d23b7a7bf260fe59c1c66fcd2006d9b34568182d926d5330b1ab34","observation_id":"26a78126-7459-4a64-adf7-f6558001cd03","resolution":{"observed_at":"2026-08-07T04:59:04.925034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-08-04T17:57:52.319352Z","title":"Never give up: Learning directed exploration strategies","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2509.14257","last_updated":"2026-07-23T12:32:53Z","snapshot_observed_at":"2026-08-05T11:19:48.609021Z","submitted_at":"2025-09-12T15:34:07Z","title":"Student-Centered Distillation Narrows the Agentic Gap Between Small and Large LLMs","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:52.319352Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2509.14257"},"observation_digest":"sha256:b0d9b94563ad1aaf1d49bc21d1d344e1ac1b3823b043e37afe0748347b80bf14","observation_id":"57244e40-7330-4372-87c8-f93f8b3b48f2","resolution":{"observed_at":"2026-08-04T17:57:52.319352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":"2002.06038","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-07-04T18:40:02.690126Z","title":"Never give up: Learning directed exploration strategies","venue":null,"work_id":"ca54caa0-72d9-4b25-b46f-b748b7ea4d4d","year":2002},"citing_paper":{"arxiv_id":"2509.25438","last_updated":"2026-04-03T16:34:50Z","snapshot_observed_at":"2026-08-08T15:49:58.765974Z","submitted_at":"2025-09-29T19:43:44Z","title":"Beyond Noisy-TVs: Noise-Robust Exploration Via Learning Progress Monitoring","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:46.257332Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2509.25438"},"observation_digest":"sha256:fdceb5d2c4c66917ceb918b532c26d53b4817994b701c21bcff3b968829f5b47","observation_id":"a17297b8-b27d-490b-a4ab-dedb2d119d7f","resolution":{"observed_at":"2026-05-18T11:51:20.199561Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-08-04T00:30:38.113645Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.00802","last_updated":"2026-06-17T02:55:02Z","snapshot_observed_at":"2026-08-10T04:22:29.408763Z","submitted_at":"2025-11-02T04:47:17Z","title":"GrowthHacker: Automated Off-Policy Evaluation Optimization Using Code-Modifying LLM Agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T00:30:38.113645Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2511.00802"},"observation_digest":"sha256:4a99db9290ec3740fd7556286f961774c320fa666ad5a35c06d0224f5e456894","observation_id":"d0929453-0725-4f45-97af-0e5499f6c402","resolution":{"observed_at":"2026-08-04T00:30:38.113645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":"2002.06038","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-07-04T18:40:02.690126Z","title":"Never give up: Learning directed exploration strategies","venue":null,"work_id":"ca54caa0-72d9-4b25-b46f-b748b7ea4d4d","year":2002},"citing_paper":{"arxiv_id":"2605.16725","last_updated":"2026-05-16T00:18:22Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-16T00:18:22Z","title":"Baba in Wonderland: Online Self-Supervised Dynamics Discovery for Executable World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T21:47:11.983066Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2605.16725"},"observation_digest":"sha256:7acb707ed7b60761477582c3c06c9408e4fc7ac562edabe569f0b66af6b06df6","observation_id":"82ea8c2c-85e5-479f-97c2-133cae128a88","resolution":{"observed_at":"2026-05-19T21:47:48.320974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":"2002.06038","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-07-04T18:40:02.690126Z","title":"Never give up: Learning directed exploration strategies","venue":null,"work_id":"ca54caa0-72d9-4b25-b46f-b748b7ea4d4d","year":2002},"citing_paper":{"arxiv_id":"2606.25198","last_updated":"2026-07-01T17:23:10Z","snapshot_observed_at":"2026-08-02T21:34:55.759064Z","submitted_at":"2026-06-23T21:44:08Z","title":"Heuresis: Search Strategies for Autonomous AI Research Agents Across Quality, Diversity and Novelty","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-25T22:42:05.112858Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2606.25198"},"observation_digest":"sha256:aaef76efe26a9af4d7126fca5d9c14d75f979009d1daa3b1f6cdfaf4961e7d09","observation_id":"eebdfe6e-ea07-4155-8678-9a1f7db78252","resolution":{"observed_at":"2026-07-04T18:40:02.691736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":"2002.06038","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-07-04T18:40:02.690126Z","title":"Never give up: Learning directed exploration strategies","venue":null,"work_id":"ca54caa0-72d9-4b25-b46f-b748b7ea4d4d","year":2002},"citing_paper":{"arxiv_id":"2606.25198","last_updated":"2026-07-01T17:23:10Z","snapshot_observed_at":"2026-08-02T21:34:55.759064Z","submitted_at":"2026-06-23T21:44:08Z","title":"Heuresis: Search Strategies for Autonomous AI Research Agents Across Quality, Diversity and Novelty","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:35.240433Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2606.25198"},"observation_digest":"sha256:569902bf8c4a2b9d199aca1d5dbb259c0af1a5667a0a61e809d793856a08aed8","observation_id":"3a36944c-e7f2-4d96-93f2-3f3f70d06463","resolution":{"observed_at":"2026-07-02T21:17:23.795265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-08-01T16:35:00.586734Z","title":"arXiv preprint arXiv:2002.06038 , year=","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.17981","last_updated":"2026-07-20T14:15:03Z","snapshot_observed_at":"2026-08-07T06:41:03.058424Z","submitted_at":"2026-07-20T14:15:03Z","title":"Information-Based Exploration via Random Features for Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T16:35:00.586734Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2607.17981"},"observation_digest":"sha256:a8e7bdddd9f224dd6b4b89d5d706df4de6b0378952394482875813627d737ac0","observation_id":"e294e5f7-8778-474d-9d8a-49704e2ca071","resolution":{"observed_at":"2026-08-01T16:35:00.586734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06038","snapshot_observed_at":"2026-08-01T01:39:36.532933Z","title":"Never give up: Learning directed exploration strategies,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.25754","last_updated":"2026-07-28T14:16:11Z","snapshot_observed_at":"2026-08-10T04:22:30.899098Z","submitted_at":"2026-07-28T14:16:11Z","title":"Cooperative Multi-UAV Navigation in Complex Environments via Systematic Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:39:36.532933Z"},"links":{"cited_paper":"/paper/2002.06038","citing_paper":"/paper/2607.25754"},"observation_digest":"sha256:fa54db4008bcf36507ca088faf7a4ea1fa01d8b7bd17f272c529bec0e6a7cb5e","observation_id":"aa0be051-4a90-4866-83bd-5efdcb9afd4f","resolution":{"observed_at":"2026-08-01T01:39:36.532933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2002.06038/citation-record","integrity":"/paper/2002.06038/integrity","json":"/paper/2002.06038/citation-record.json","paper":"/paper/2002.06038"},"outbound":[],"paper":{"arxiv_id":"2002.06038","last_updated":"2020-02-14T13:57:22Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T08:57:20.804732Z","submitted_at":"2020-02-14T13:57:22Z","title":"Never Give Up: Learning Directed Exploration Strategies"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2002.06038."}