{"as_of":"2026-08-08T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cdb5ebdac17e67f046c833c868f030694bb45f4102f5850781d8ed3fef46842b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:26:17.660152Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:58.308235Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-16T12:55:40.245908Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2505.18719"},"observation_digest":"sha256:080d63563579a336c5eac74ee4eb6a2625e59c4314b51ef6ebf490e17fda7560","observation_id":"3364acc7-9aa7-4326-8492-fcdad8c6e926","resolution":{"observed_at":"2026-05-16T12:55:40.358784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-06T19:26:17.660152Z","title":"Rldg: Robotic generalist policy dis- tillation via reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05674","last_updated":"2025-09-12T04:53:53Z","snapshot_observed_at":"2026-08-07T06:19:36.738976Z","submitted_at":"2025-07-08T04:57:23Z","title":"Integrating Diffusion-based Multi-task Learning with Online Reinforcement Learning for Robust Quadruped Robot Control","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:26:17.660152Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2507.05674"},"observation_digest":"sha256:4b53fb99050f9be80ed605075af1a6d4d0ea629cb117c51b5e5151300b44b366","observation_id":"360cd47c-54bd-481e-a586-d2ea7a05add6","resolution":{"observed_at":"2026-08-06T19:26:17.660152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-05T16:41:54.320097Z","title":"RLDG: Robotic generalist policy distillation via reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18066","last_updated":"2025-08-25T14:22:40Z","snapshot_observed_at":"2026-08-05T16:41:52.474739Z","submitted_at":"2025-08-25T14:22:40Z","title":"Arnold: a generalist muscle transformer policy","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T16:41:54.320097Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2508.18066"},"observation_digest":"sha256:ab774aba446b6cd9e2d4758cc3a7540af5b8c98acc9f1f3b01d6c4b6e0665e72","observation_id":"898b5141-124a-41f3-8456-6dccdf659324","resolution":{"observed_at":"2026-08-05T16:41:54.320097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:9bdfad84ed44e8b143b92af0b59cbb2cdb6f6a7978ec4a52789d06b3c713605c","observation_id":"298d2bfe-c995-4e35-9711-a71c32863790","resolution":{"observed_at":"2026-05-12T10:34:59.374709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-02T23:48:00.200266Z","title":"RLDG: robotic generalist policy distillation via rein- forcement learning.CoRR, abs/2412.09858, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.12691","last_updated":"2026-06-20T06:22:27Z","snapshot_observed_at":"2026-08-06T14:37:27.953191Z","submitted_at":"2026-02-13T07:46:37Z","title":"ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T23:48:00.200266Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2602.12691"},"observation_digest":"sha256:ea6a5b67d174bc435eefe923a940189bf17ab14b573623cb83187f6b6a1f0b51","observation_id":"1fe7b4aa-83b4-4e27-a0c9-959c76ea977d","resolution":{"observed_at":"2026-08-02T23:48:00.200266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-08-05T18:18:04.172934Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T11:42:34.409651Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2604.15483"},"observation_digest":"sha256:00e94894e54abe6e74036680eba759d4d767f6da2c1c0af5a007511079aa4d41","observation_id":"a6bac5bf-d19d-453b-b1a2-575a2262b002","resolution":{"observed_at":"2026-05-10T11:45:21.728091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2605.00416","last_updated":"2026-06-03T08:01:40Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T05:20:26Z","title":"Learning While Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-09T19:31:38.069592Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2605.00416"},"observation_digest":"sha256:c850e8280cc9c85f75995e96382c9889af37d933f41123cd09ef862defb96dd0","observation_id":"1a33a8ec-78ce-4ec8-acf0-89a077ad6181","resolution":{"observed_at":"2026-05-11T15:36:10.916898Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2605.00416","last_updated":"2026-06-03T08:01:40Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T05:20:26Z","title":"Learning While Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-01T08:05:47.128354Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2605.00416"},"observation_digest":"sha256:275f0f673cee73773d2552dc48c852398b910d0d69e8d79a1fa9da3e58e085ad","observation_id":"8f56a2a4-f713-460f-b1f0-517b52dff45c","resolution":{"observed_at":"2026-07-01T08:15:32.390805Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2605.25210","last_updated":"2026-05-24T18:19:40Z","snapshot_observed_at":"2026-07-31T17:51:56.004972Z","submitted_at":"2026-05-24T18:19:40Z","title":"Multi-Objective Learning for Diffusion Models: A Statistical Theory under Semi-Supervised Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T12:09:27.409746Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2605.25210"},"observation_digest":"sha256:c818bfb760b891b2dd0aecd0620c2b952ca80feaa916cdd7b7ae5f961400bcfa","observation_id":"6008e264-f2bc-4cc8-b535-58f40c74c76b","resolution":{"observed_at":"2026-06-30T12:34:39.422800Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.06461","last_updated":"2026-06-04T17:51:12Z","snapshot_observed_at":"2026-07-06T23:46:15.936608Z","submitted_at":"2026-06-04T17:51:12Z","title":"Flow-based Policy Adaptation without Policy Updates","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T01:18:08.001674Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.06461"},"observation_digest":"sha256:7700178323656edd8291a2958fd51544eff9ab810a93f8443b548dc64f691237","observation_id":"17a9adad-e6d9-44dc-9c31-3d559f5d3484","resolution":{"observed_at":"2026-07-02T13:26:59.171127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.09615","last_updated":"2026-06-08T15:21:45Z","snapshot_observed_at":"2026-08-03T16:03:00.502890Z","submitted_at":"2026-06-08T15:21:45Z","title":"DexPIE: Stable Dexterous Policy Improvement from Real-World Experience","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T16:47:22.504175Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.09615"},"observation_digest":"sha256:be20f0417c07336cfdd6b19f11956101db5c08ebcfa9027254a6361686c82aa8","observation_id":"8270259e-b914-4de0-851f-481fa9787007","resolution":{"observed_at":"2026-07-03T01:07:30.753147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.10927","last_updated":"2026-06-09T14:35:53Z","snapshot_observed_at":"2026-08-01T15:29:53.973770Z","submitted_at":"2026-06-09T14:35:53Z","title":"AllDayNav: Lifelong Navigation via Real-World Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T13:25:59.194721Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.10927"},"observation_digest":"sha256:682ff37bcd9f7e34e506e308362df8748b286d6c09a9bf03b216bd139fc3cb0e","observation_id":"cfbea7c4-f093-4a13-9c56-293551becfd1","resolution":{"observed_at":"2026-07-03T05:07:38.967081Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.13675","last_updated":"2026-06-11T17:59:45Z","snapshot_observed_at":"2026-07-30T00:58:38.369141Z","submitted_at":"2026-06-11T17:59:45Z","title":"Improving Robotic Generalist Policies via Flow Reversal Steering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T06:20:19.209180Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.13675"},"observation_digest":"sha256:09a9fd2977be7c726bbb4b715c8cb90f2c393e610877694716346b162eaee4f4","observation_id":"dc49a3a3-079f-48c7-82cc-22ea3731d402","resolution":{"observed_at":"2026-07-03T15:48:35.751705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.16776","last_updated":"2026-06-28T12:48:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-15T14:21:35Z","title":"JoyAI-Sim: A Simulation-Enabled Interconversion Toolchain for the Embodied Data Pyramid","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T10:31:54.292897Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.16776"},"observation_digest":"sha256:b7ee50c4edca23b2e43a306ce4d104593b5ac0063596a2962372b35ccfd803a5","observation_id":"62d40101-1ed8-4d44-9e87-b271bf9dba30","resolution":{"observed_at":"2026-06-30T10:34:36.299082Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.22471","last_updated":"2026-06-29T14:49:32Z","snapshot_observed_at":"2026-08-07T17:41:39.498544Z","submitted_at":"2026-06-21T12:31:59Z","title":"Scalable Multi-Task Data Generation via Reinforcement Learning for Language-Conditioned Bimanual Dexterous Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T10:18:01.230648Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.22471"},"observation_digest":"sha256:7858c5af8e515b6cab173861ed22e836c13e8ba7da0b86185053b06ce003d2f9","observation_id":"e2a28978-94d0-46ca-aa7e-c48aa2622140","resolution":{"observed_at":"2026-07-04T09:19:42.939427Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.22471","last_updated":"2026-06-29T14:49:32Z","snapshot_observed_at":"2026-08-07T17:41:39.498544Z","submitted_at":"2026-06-21T12:31:59Z","title":"Scalable Multi-Task Data Generation via Reinforcement Learning for Language-Conditioned Bimanual Dexterous Manipulation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T10:46:26.385071Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.22471"},"observation_digest":"sha256:e87336a78e9a15e5793e7868a4201e99754b1cb79b772b19b026458d8c12e62e","observation_id":"0fb83220-c451-4f5b-8c9c-c6527a00d5d1","resolution":{"observed_at":"2026-06-30T10:54:36.971120Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.24884","last_updated":"2026-06-23T17:59:01Z","snapshot_observed_at":"2026-08-08T03:34:49.957851Z","submitted_at":"2026-06-23T17:59:01Z","title":"InSight: Self-Guided Skill Acquisition via Steerable VLAs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T00:10:51.721485Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.24884"},"observation_digest":"sha256:17aeee6b5bc0f6489d262d45ee46db7a190b63d81166d49739e3f64701032d59","observation_id":"e64a8b7e-6135-4813-bd8b-490bde4e5899","resolution":{"observed_at":"2026-07-04T16:49:58.309660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-01T14:39:52.278110Z","title":"arXiv preprint arXiv:2412.09858 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18709","last_updated":"2026-07-22T05:33:17Z","snapshot_observed_at":"2026-08-04T15:25:40.989347Z","submitted_at":"2026-07-21T05:05:01Z","title":"RoboInter1.5: A Holistic Intermediate Representation Suite for Embodied World Modeling and Robotic Manipulation","version":2},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-08-01T14:39:52.278110Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2607.18709"},"observation_digest":"sha256:00a8703af8765e9f28301764461c6dcb96ecf4403049eca67c6d9a87818b0332","observation_id":"6f15f21a-c235-49f2-ad1e-e3fc6bf16095","resolution":{"observed_at":"2026-08-01T14:39:52.278110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.09858/citation-record","integrity":"/paper/2412.09858/integrity","json":"/paper/2412.09858/citation-record.json","paper":"/paper/2412.09858"},"outbound":[],"paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2412.09858."}