{"as_of":"2026-08-16T03:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6dcb8988d2481e55e54dc7603ccbec4182aa8a208e4bc224638287a3dee969a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:00:39.360466Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T16:47:24.453726Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-08-10T17:00:39.360466Z","title":"Parrot: Data-driven behavioral priors for re- inforcement learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.12668","last_updated":"2025-05-20T04:44:56Z","snapshot_observed_at":"2026-08-15T09:08:41.194479Z","submitted_at":"2025-01-22T06:08:15Z","title":"NBDI: A Simple and Effective Termination Condition for Skill Extraction from Task-Agnostic Demonstrations","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:00:39.360466Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2501.12668"},"observation_digest":"sha256:7ba20255bdfce25b07952f78298e014ac43d9d488bb5d0a4c91d2492f05c2912","observation_id":"7ae88fbb-def1-4a3c-8136-190aae601a21","resolution":{"observed_at":"2026-08-10T17:00:39.360466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-08-07T05:37:46.379573Z","title":"Parrot: Data-driven behavioral priors for reinforcement learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.07505","last_updated":"2025-06-09T07:32:52Z","snapshot_observed_at":"2026-08-13T23:13:11.231468Z","submitted_at":"2025-06-09T07:32:52Z","title":"Reinforcement Learning via Implicit Imitation Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:37:46.379573Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2506.07505"},"observation_digest":"sha256:f3305c941692081319500b7bffc9549d43377bf9235892e6f8a08617b238e25f","observation_id":"13036d68-8079-4468-a573-ac508a627241","resolution":{"observed_at":"2026-08-07T05:37:46.379573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.10024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-07-10T16:47:24.453726Z","title":"arXiv preprint arXiv:2011.10024 , year=","venue":"cs.LG","work_id":"0432c5f9-f5c2-4b3d-a73d-ba49bc67b43d","year":2020},"citing_paper":{"arxiv_id":"2506.15799","last_updated":"2025-06-25T19:09:52Z","snapshot_observed_at":"2026-08-08T08:13:32.220639Z","submitted_at":"2025-06-18T18:35:57Z","title":"Steering Your Diffusion Policy with Latent Space Reinforcement Learning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-17T21:55:46.183007Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2506.15799"},"observation_digest":"sha256:95eada8155548356b8f792796e5c3a85d48e402f507b1efc60188f36b3454a99","observation_id":"c064e2b8-5329-4fc7-b472-615cbfc0ccf8","resolution":{"observed_at":"2026-05-17T21:55:46.273065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-08-06T18:15:46.657876Z","title":"Parrot: Data-driven behavioral priors for re- inforcement learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.09041","last_updated":"2025-07-11T21:36:19Z","snapshot_observed_at":"2026-08-09T05:31:23.348356Z","submitted_at":"2025-07-11T21:36:19Z","title":"Behavioral Exploration: Learning to Explore via In-Context Adaptation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:15:46.657876Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2507.09041"},"observation_digest":"sha256:7dc6403f9538a285f3f32b64673397440d19db999740adb0c33718102aa3cc92","observation_id":"0f89f866-955c-4bf4-ba38-85ca2722bb14","resolution":{"observed_at":"2026-08-06T18:15:46.657876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.10024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-07-10T16:47:24.453726Z","title":"arXiv preprint arXiv:2011.10024 , year=","venue":"cs.LG","work_id":"0432c5f9-f5c2-4b3d-a73d-ba49bc67b43d","year":2020},"citing_paper":{"arxiv_id":"2605.21822","last_updated":"2026-05-20T23:44:06Z","snapshot_observed_at":"2026-08-12T17:48:15.828969Z","submitted_at":"2026-05-20T23:44:06Z","title":"Implicit Safety Alignment from Crowd Preferences","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-22T08:28:41.652865Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2605.21822"},"observation_digest":"sha256:b73028b4eedeb515a28a65f526581309bbd215cc085fb48d4bf8b6920238be0e","observation_id":"5afaf2c9-7d65-4e0a-91de-c1b6433941a5","resolution":{"observed_at":"2026-05-22T08:31:16.870564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.10024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-07-10T16:47:24.453726Z","title":"arXiv preprint arXiv:2011.10024 , year=","venue":"cs.LG","work_id":"0432c5f9-f5c2-4b3d-a73d-ba49bc67b43d","year":2020},"citing_paper":{"arxiv_id":"2606.01151","last_updated":"2026-08-08T10:30:40Z","snapshot_observed_at":"2026-08-15T22:48:56.335853Z","submitted_at":"2026-05-31T10:40:28Z","title":"Lagrangian Perturbation Diffusion Steering: Latent Reinforcement Learning for Generative Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T17:19:36.722892Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2606.01151"},"observation_digest":"sha256:c50c6bbe41a89cb08b59502072896b19ffd5bbd83cd372656e13defa169b37b7","observation_id":"bb5b1c6a-5669-46ca-9a48-133ddd4b8d98","resolution":{"observed_at":"2026-06-28T17:22:24.635696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.10024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-07-10T16:47:24.453726Z","title":"arXiv preprint arXiv:2011.10024 , year=","venue":"cs.LG","work_id":"0432c5f9-f5c2-4b3d-a73d-ba49bc67b43d","year":2020},"citing_paper":{"arxiv_id":"2606.12200","last_updated":"2026-06-10T15:19:41Z","snapshot_observed_at":"2026-07-06T23:51:07.629939Z","submitted_at":"2026-06-10T15:19:41Z","title":"Implicit Neural Representations of Individual Behavior","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-27T10:27:47.896922Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2606.12200"},"observation_digest":"sha256:56678d46b5e474949ed5129dc72f080d1d502fd190761fbc6df2cf21bc3104a7","observation_id":"15f1425b-3325-45f7-8f18-c9050bfaac84","resolution":{"observed_at":"2026-07-03T09:17:48.511393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.10024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-07-10T16:47:24.453726Z","title":"arXiv preprint arXiv:2011.10024 , year=","venue":"cs.LG","work_id":"0432c5f9-f5c2-4b3d-a73d-ba49bc67b43d","year":2020},"citing_paper":{"arxiv_id":"2606.13795","last_updated":"2026-06-17T17:53:46Z","snapshot_observed_at":"2026-08-14T19:03:44.084753Z","submitted_at":"2026-06-11T18:06:04Z","title":"DiPOD: Diffusion Policy Optimization without Drifting Apart","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T07:06:28.426709Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2606.13795"},"observation_digest":"sha256:5ad81daa8546793329cd12a129d2c94527c74f4941bce928fbd2fcc96b24b9bc","observation_id":"0490dc30-4fa1-46f9-9922-76ad4b0bb0d1","resolution":{"observed_at":"2026-07-03T14:18:22.938679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.10024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-07-10T16:47:24.453726Z","title":"arXiv preprint arXiv:2011.10024 , year=","venue":"cs.LG","work_id":"0432c5f9-f5c2-4b3d-a73d-ba49bc67b43d","year":2020},"citing_paper":{"arxiv_id":"2606.31958","last_updated":"2026-06-30T17:00:33Z","snapshot_observed_at":"2026-07-07T00:05:37.068846Z","submitted_at":"2026-06-30T17:00:33Z","title":"Adapting Generalist Robot Policies with Semantic Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-01T05:09:29.625066Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2606.31958"},"observation_digest":"sha256:f74a5bfd51a16a8bf9ff8c299fe16e7ccab31657d163c954c2a88fabf56957be","observation_id":"9d2955b7-1f96-4322-93e8-1b51e59aa951","resolution":{"observed_at":"2026-07-01T10:45:42.689245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.10024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-07-10T16:47:24.453726Z","title":"arXiv preprint arXiv:2011.10024 , year=","venue":"cs.LG","work_id":"0432c5f9-f5c2-4b3d-a73d-ba49bc67b43d","year":2020},"citing_paper":{"arxiv_id":"2607.07855","last_updated":"2026-07-08T18:33:48Z","snapshot_observed_at":"2026-08-13T20:30:29.084746Z","submitted_at":"2026-07-08T18:33:48Z","title":"NFTR: From Provable Mode-Averaging to Geodesic Subgoal Selection in Offline Goal-Conditioned RL","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-10T16:39:10.354308Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2607.07855"},"observation_digest":"sha256:fcd04663264883bd3863f608b928f50739492bbf96bbc9cfce84c7da86f86d75","observation_id":"e65c9b04-a47b-493b-aa93-bef4ebc0e224","resolution":{"observed_at":"2026-07-10T16:47:24.454982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.10024","snapshot_observed_at":"2026-08-04T19:45:35.236218Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-15T02:22:30.824958Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":239,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:35.236218Z"},"links":{"cited_paper":"/paper/2011.10024","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:369c7de36e8b54188d547a77fa76359069414d96482d9bb2b5d861702ed6b05b","observation_id":"e39b0cc2-7494-4bcc-9111-a3f140fc3520","resolution":{"observed_at":"2026-08-04T19:45:35.236218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2011.10024/citation-record","integrity":"/paper/2011.10024/integrity","json":"/paper/2011.10024/citation-record.json","paper":"/paper/2011.10024"},"outbound":[],"paper":{"arxiv_id":"2011.10024","last_updated":"2020-11-19T18:47:40Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T11:41:18.253452Z","submitted_at":"2020-11-19T18:47:40Z","title":"Parrot: Data-Driven Behavioral Priors for Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2011.10024."}