{"as_of":"2026-08-08T19:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c12842f9d5ba73d6f13ef2215c572aaa936f29ced119a42b5a8dd4844ace21d","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:06:06.951316Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06701/citation-record","integrity":"/paper/2507.06701/integrity","json":"/paper/2507.06701/citation-record.json","paper":"/paper/2507.06701"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00597","last_updated":"2022-03-22T10:14:14Z","snapshot_observed_at":"2026-08-02T19:26:55.644557Z","submitted_at":"2021-12-01T16:12:32Z","title":"Wish you were here: Hindsight Goal Selection for long-horizon dexterous manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00597","snapshot_observed_at":"2026-08-06T19:06:06.116005Z","title":"Davchev, T., Sushkov, O","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.116005Z"},"links":{"cited_paper":"/paper/2112.00597","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:32ce2d7d279008070e81a41c357360f3196c2aedfe74be549bda65efce01304c","observation_id":"a27a6172-f7a0-46cf-b531-e4a07e871936","resolution":{"observed_at":"2026-08-06T19:06:06.116005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-08-08T03:18:33.595658Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06175","snapshot_observed_at":"2026-08-06T19:06:06.602130Z","title":"Reed, S., Zolna, K., Parisotto, E., Colmenarejo, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.602130Z"},"links":{"cited_paper":"/paper/2205.06175","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:ef69714b49fb2844e523c2b09a414ffdd3d53c947342ad40975dfb6cd8e3a3e2","observation_id":"35e2ba22-e5ea-4da3-aa74-c9507fab7691","resolution":{"observed_at":"2026-08-06T19:06:06.602130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:07.413262Z","title":null,"venue":null,"work_id":"75713d0d-854c-4258-adc4-93ad7c3ea71d","year":2016},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.743130Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:1f620fc9b90cf39f06471a84f11d4f499711c08200b0a8cc66f471a6c89a43cf","observation_id":"1d3d755d-d3b6-4273-a0a9-604db3f09052","resolution":{"observed_at":"2026-08-06T19:06:07.444819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13885","last_updated":"2020-11-27T18:20:04Z","snapshot_observed_at":"2026-07-06T10:18:28.593525Z","submitted_at":"2020-11-27T18:20:04Z","title":"Offline Learning from Demonstrations and Unlabeled Experience","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13885","snapshot_observed_at":"2026-08-06T19:06:06.902037Z","title":"Zolna, K., Novikov, A., Konyushkova, K., Gulcehre, C., Wang, Z., Aytar, Y ., Denil, M., de Freitas, N., and Reed, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.902037Z"},"links":{"cited_paper":"/paper/2011.13885","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:2d381a2960490efb36780e82c8e85958ecd1d69749c32cdeeb4bac51bd9cf565","observation_id":"99c2d47e-7fff-4ee7-b1fd-7501c86f79c6","resolution":{"observed_at":"2026-08-06T19:06:06.902037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:07.279060Z","title":null,"venue":null,"work_id":"4532ccc9-a813-41b1-857c-caf56426a5a3","year":2023},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.951316Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:91ca591dba5119e4fb93fc7c3b5a2cbc7f4703a5589d8a511f3e5bd92084480c","observation_id":"9c306700-d951-45f0-8fea-32d6a439cce9","resolution":{"observed_at":"2026-08-06T19:06:07.318510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11610","last_updated":"2022-10-25T17:45:17Z","snapshot_observed_at":"2026-07-06T14:08:26.493996Z","submitted_at":"2022-10-20T21:53:54Z","title":"Large Language Models Can Self-Improve","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11610","snapshot_observed_at":"2026-08-06T19:06:06.248583Z","title":"cc/paper_files/paper/2014/file/ 5ca3e9b122f61f8f06494c97b1afccf3-Paper","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.248583Z"},"links":{"cited_paper":"/paper/2210.11610","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:6c21258e88f3feee97a833ba17ba7d8ea9701b6dae3036ee11e39fde6165fd7e","observation_id":"379b2b3e-48a3-4756-a055-b3f92a1131a7","resolution":{"observed_at":"2026-08-06T19:06:06.248583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1507.04888","last_updated":"2016-03-11T11:02:00Z","snapshot_observed_at":"2026-07-06T04:24:07.477067Z","submitted_at":"2015-07-17T09:30:03Z","title":"Maximum Entropy Deep Inverse Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.04888","snapshot_observed_at":"2026-08-06T19:06:06.805435Z","title":"cc/paper_files/paper/2018/file/ 4aec1b3435c52abbdf8334ea0e7141e0-Paper","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.805435Z"},"links":{"cited_paper":"/paper/1507.04888","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:aa73dcfc820e170e01367a4f606b9eebc66b86e8d3d280ac4ca55ca86c3c769d","observation_id":"29bfdde9-336a-4003-b743-3b7accb25f0d","resolution":{"observed_at":"2026-08-06T19:06:06.805435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:06.454510Z","title":"Kwon, T., Palo, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.454510Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:0bdbdd8927efc3364620a330c8daeb0137db59b8337cc9929b703c8ec6dbd06d","observation_id":"4a047633-9609-4812-8932-74bf9035e92d","resolution":{"observed_at":"2026-08-06T19:06:06.454510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07749","last_updated":"2021-06-10T23:54:34Z","snapshot_observed_at":"2026-08-06T05:54:55.251384Z","submitted_at":"2021-04-15T20:10:11Z","title":"Actionable Models: Unsupervised Offline Reinforcement Learning of Robotic Skills","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07749","snapshot_observed_at":"2026-08-06T19:06:06.043894Z","title":"Chebotar, Y ., Hausman, K., Lu, Y ., Xiao, T., Kalashnikov, D., Varley, J., Irpan, A., Eysenbach, B., Julian, R., Finn, C., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.043894Z"},"links":{"cited_paper":"/paper/2104.07749","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:5f78e4652a8d64245d50737e4fc5abafe36fb3272fe781d186d865f1090aeafa","observation_id":"98b7e95c-a3b6-4886-ab6d-1702aa029fe1","resolution":{"observed_at":"2026-08-06T19:06:06.043894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.05032","last_updated":"2019-12-10T22:31:09Z","snapshot_observed_at":"2026-08-08T14:42:38.373950Z","submitted_at":"2019-12-10T22:31:09Z","title":"Imitation Learning via Off-Policy Distribution Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.05032","snapshot_observed_at":"2026-08-06T19:06:06.332378Z","title":"Kostrikov, I., Agrawal, K","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.332378Z"},"links":{"cited_paper":"/paper/1912.05032","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:8e8e5d432c917b9f2f7e32e8301fe4f4b8f0206da7b2ebaf3e94c85ddbcbbf78","observation_id":"a695a859-fe68-432b-9b3f-443714294e47","resolution":{"observed_at":"2026-08-06T19:06:06.332378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01369","last_updated":"2024-12-09T14:26:42Z","snapshot_observed_at":"2026-08-04T00:02:01.409816Z","submitted_at":"2024-09-02T16:48:57Z","title":"Imitating Language via Scalable Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01369","snapshot_observed_at":"2026-08-06T19:06:06.864052Z","title":"org/CorpusID:265609417","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.864052Z"},"links":{"cited_paper":"/paper/2409.01369","citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:7ca3ce1892d8af8ecd64baba85866b7bdba1122822a7e830afb8d569820fd04f","observation_id":"d3dbb16b-69ea-4a80-9af1-4462da4e71b3","resolution":{"observed_at":"2026-08-06T19:06:06.864052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:06:06.677382Z","title":"org/CorpusID:269605913","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:06:06.677382Z"},"links":{"citing_paper":"/paper/2507.06701"},"observation_digest":"sha256:9f94b331e7844881397395fb9ea374f2fb3bcc0491c3349b3f242ee8e815df80","observation_id":"a681f6c3-2c41-460e-9cd3-9279e8e30a02","resolution":{"observed_at":"2026-08-06T19:06:06.677382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06701","last_updated":"2025-07-09T09:55:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T09:14:43.702922Z","submitted_at":"2025-07-09T09:55:23Z","title":"Value from Observations: Towards Large-Scale Imitation Learning via Self-Improvement"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2507.06701."}