{"as_of":"2026-08-05T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c5112842815e27d2e9e3a6b6940827e716a6e5f684d6165f36dd70cfa2ccd418","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:45:26.462169Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T23:57:29.181327Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2106.01345","last_updated":"2021-06-24T17:09:59Z","snapshot_observed_at":"2026-07-06T11:15:20.397336Z","submitted_at":"2021-06-02T17:53:39Z","title":"Decision Transformer: Reinforcement Learning via Sequence Modeling","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T15:11:11.056013Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2106.01345"},"observation_digest":"sha256:57a012d6f061bf5315bdb024ea9234bec151f0c6ee5511632b53c1f754189962","observation_id":"e67ef3e2-5dc7-4102-b3b9-af35d619c232","resolution":{"observed_at":"2026-05-18T15:11:11.314700Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T08:51:55.826747Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2108.03298"},"observation_digest":"sha256:e6631be4455a1d7801b699c5099ce42aa67c4e5a8251d5303fc61935cbd61af8","observation_id":"24ac5f17-dd9e-4fd0-82fd-598970556c8f","resolution":{"observed_at":"2026-05-13T08:51:55.958219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-04T08:45:47.978112Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.19528","last_updated":"2026-06-16T14:16:10Z","snapshot_observed_at":"2026-08-04T08:45:45.421057Z","submitted_at":"2025-10-22T12:32:52Z","title":"Learning Upper Lower Value Envelopes to Shape Online RL: A Principled Approach","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T08:45:47.978112Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2510.19528"},"observation_digest":"sha256:6cc6101c694a145f42f9c3b281ada8868852999e037877e76cc7d7a56f49e8bd","observation_id":"fbbd8599-f619-4da0-873b-2e186e9b76db","resolution":{"observed_at":"2026-08-04T08:45:47.978112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-03T15:05:01.788849Z","title":"Opal: Offline primitive discovery for accelerating offline reinforcement learning.arXiv preprint arXiv:2010.13611, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2512.18368","last_updated":"2026-07-02T04:31:01Z","snapshot_observed_at":"2026-08-03T15:05:00.790623Z","submitted_at":"2025-12-20T13:46:08Z","title":"Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T15:05:01.788849Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2512.18368"},"observation_digest":"sha256:e9a6eeae86749c965e15e09633ebd2f0fb6c1bb7a8c4d6e697ae5a9fb21241e3","observation_id":"384aca80-181a-45a0-93e7-fffcd6613991","resolution":{"observed_at":"2026-08-03T15:05:01.788849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2605.21822","last_updated":"2026-05-20T23:44:06Z","snapshot_observed_at":"2026-08-03T02:30:10.701058Z","submitted_at":"2026-05-20T23:44:06Z","title":"Implicit Safety Alignment from Crowd Preferences","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-22T08:28:41.652865Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2605.21822"},"observation_digest":"sha256:31b0688365029a15de6f9a32a07495af1c4e9a7aca0d3910520f5c5e2e58b7d3","observation_id":"22e07cd7-df74-4651-be1c-1af7f93bbba8","resolution":{"observed_at":"2026-05-22T08:31:16.907176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2606.09115","last_updated":"2026-06-08T07:11:03Z","snapshot_observed_at":"2026-08-04T22:59:05.251199Z","submitted_at":"2026-06-08T07:11:03Z","title":"Counterfactual Transport Flows for Offline Conservative Trajectory Refinement","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-27T17:33:35.857240Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2606.09115"},"observation_digest":"sha256:4cbb0363c77c9df5b480dd23f1738cdf50d9f4ae3c5d8654d6a764dfaec91aae","observation_id":"1fa937b6-3149-4cd3-89a4-eddf17901ccd","resolution":{"observed_at":"2026-07-02T23:57:29.182689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2606.29201","last_updated":"2026-06-28T05:01:27Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T05:01:27Z","title":"Behavior Uncloning: Distilling Mode Redirection into Policy Weights without Inference-Time Steering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T07:49:04.825693Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2606.29201"},"observation_digest":"sha256:15d6c32a54bb6f4844beba9e635325e50d7e6063cbf8d6575f1e069c20a08a55","observation_id":"097a2308-2c05-487d-91ef-4ae79db223c1","resolution":{"observed_at":"2026-06-30T07:54:22.212408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2010.13611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-07-02T23:57:29.181327Z","title":"arXiv preprint arXiv:2010.13611 , year=","venue":null,"work_id":"f9618456-5a8a-4cb1-bb2e-9fa7e089e5c1","year":2010},"citing_paper":{"arxiv_id":"2606.31958","last_updated":"2026-06-30T17:00:33Z","snapshot_observed_at":"2026-07-07T00:05:37.068846Z","submitted_at":"2026-06-30T17:00:33Z","title":"Adapting Generalist Robot Policies with Semantic Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-01T05:09:29.625066Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2606.31958"},"observation_digest":"sha256:6b614d2122031420be5f58bdf11cfb8a76a396f96b49ff9066362c61ebaef252","observation_id":"01c0d124-f73a-4f69-979b-8e84014c9005","resolution":{"observed_at":"2026-07-01T10:45:42.729562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.13611","snapshot_observed_at":"2026-08-04T19:45:26.462169Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-05T23:27:41.799773Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:26.462169Z"},"links":{"cited_paper":"/paper/2010.13611","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:dda25e9450a94d709fe75b6f78c140c2585d53c6301571949e974dad3850a2e0","observation_id":"ed133a94-6119-455a-9f1d-3b4e59acae50","resolution":{"observed_at":"2026-08-04T19:45:26.462169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2010.13611/citation-record","integrity":"/paper/2010.13611/integrity","json":"/paper/2010.13611/citation-record.json","paper":"/paper/2010.13611"},"outbound":[],"paper":{"arxiv_id":"2010.13611","last_updated":"2021-05-04T19:20:46Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T10:08:36.623926Z","submitted_at":"2020-10-26T14:31:08Z","title":"OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2010.13611."}