{"as_of":"2026-08-15T22:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:359d1f30cca1ec4db525cdac21af03d658b34eb663a952a1421341a96ff1f41a","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T23:00:31.128534Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.17720/citation-record","integrity":"/paper/2603.17720/integrity","json":"/paper/2603.17720/citation-record.json","paper":"/paper/2603.17720"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Implicit behavioral cloning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:4ca06e7e7961bccd0816438bd5b0722c4f17760ee24d9381f6b8b1c7dc562838","observation_id":"a4137395-ab5f-4785-82f8-93474a9f745a","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:bafd8f0821dcbe5308fd2b9e57d5fe3644e10af577b9881d241cc1ca7f14408e","observation_id":"b83df71a-d984-4c80-8ebd-17b144d79a7c","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03954","last_updated":"2024-09-27T02:43:48Z","snapshot_observed_at":"2026-08-01T16:34:39.855742Z","submitted_at":"2024-03-06T18:58:49Z","title":"3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03954","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"3d diffusion policy: Generalizable visuomotor policy learning via simple 3d representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2403.03954","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:335d8613384b1f5244a2f7019a9b6871d3ab8a31d96f2847642bdc994ed440c5","observation_id":"934c32c9-dbc8-4b43-be89-82d77dd20221","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17817","last_updated":"2023-10-19T19:36:31Z","snapshot_observed_at":"2026-08-13T11:05:08.748276Z","submitted_at":"2023-06-30T17:34:06Z","title":"Act3D: 3D Feature Field Transformers for Multi-Task Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17817","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Act3d: 3d feature field transformers for multi-task robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2306.17817","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:54930899b2bac2055c2f8623b1ccd2187496c08d247a32a4902f45185aa820df","observation_id":"4159f065-d677-42d7-a4f8-0b6f7b4d4b23","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Learning human-to-robot handovers from point clouds,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:b80a6cd64253353287765b7f253ef6ac31ac7af6e558be7fe06ff9468a42feeb","observation_id":"a696aa40-cfca-46a3-83f1-9e9535d9b85b","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"The ingredients for robotic diffusion transformers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:13cabc78b940119e7b30864e86464f7852e61cecc7f6ffb337150272978cdcbd","observation_id":"47c3a701-6839-41ca-a618-b5072b076e75","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learn- ing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:5fd6238b69509d8fafcd985c226a6312660833fa450dfec52fb20726347d7676","observation_id":"90b99935-4041-45b5-b9ee-c654b86f6c32","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Using proba- bilistic movement primitives in robotics,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:3975e47d6c248e4d2c8b3c8f4dc8817b84b3f2b6fe1a3fbff639575f183b7ad7","observation_id":"fcd66c55-fe23-48ad-8f13-531b17af7be7","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Efficient reductions for imitation learning,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:a18adb440173ee109b6a050470dd59bc5b3c049cb7c5f7c2b4243e825176a709","observation_id":"a028c151-1caa-440e-94c0-6514a7813dd7","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:5d5df3b33649a96edef5bd4fa44cc8d90dbe28697a5c85ffbf57a3c4a90a4e12","observation_id":"0e0d02b7-405b-4a38-8438-67e28a40c053","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Domain generalization: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:b6a97b40086bf29e1ec56b6a3181d652dfdf44bf1873a00e8db75beafa06f5c0","observation_id":"9bf4e198-5978-4a25-80d0-f191a1bd1d3d","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-08-14T11:25:08.505775Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"What matters in learning from offline human demonstrations for robot manipula- tion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:db1b8f9132e3a51ff7da111308bc9c78df69307cb2e9628e67a51be68ae00f0c","observation_id":"5224687c-8b3d-4d66-99ee-d2e4710b2f5d","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Behavior transformers: Cloningkmodes with one stone,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:de65b06ffeb30031d7c7544430415431db1af78da29f8e243c560c003d2d9aa2","observation_id":"13bae356-0f9a-4094-b2ce-0e0ac08343fc","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Spatial action maps for mobile manipulation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:adf347390770d2c2290950aa313c4fc06e3588c011bbe9ba8bbe52f9b0ac99c9","observation_id":"748f1b1f-7780-4104-a4d4-24287e950f17","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Diffusion model-augmented behavioral cloning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:ea5207a79afbf0264a0e31c7dc90e7a50c3823fac187ffb9ef508f7381606ac7","observation_id":"892ae3d1-120b-49d4-8211-0eb1e70d6144","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:241f94ce3b9e5aecb60f9350dae3f2d7c3f984532ee58afb8cc1190dc496bbc1","observation_id":"1d91d114-4d93-4aca-add9-3c755080977e","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Score-based generative modeling through stochastic differential equations,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:2e02360097a254619ecbe2569a1ced755fad52d4c998a0961fb658a801ee1c7c","observation_id":"874ddbb6-af72-468f-afb8-270c66c17782","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:dd94b45a8c1ff5c0268a6e3951e930b72779a18d9c0a6c45f8567724024cde62","observation_id":"1dce8ba4-60bb-4d4a-96bf-102f991f00e2","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Crossway diffu- sion: Improving diffusion-based visuomotor policy via self-supervised learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:1f82152c6c021a1c4a2a2beb26f31d3f95ec717e429c17d5a74ea1056a87c581","observation_id":"f3f97b1c-dfa0-4295-89ed-4140a0f31a20","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Octo: An open-source generalist robot policy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:797907e216a5de876801cc0c244cbc2e32f04da9d77ab265db57e833b53e62a7","observation_id":"8dd1ca45-4644-47dd-b1d5-0c132630ff22","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Aloha unleashed: A simple recipe for robot dexterity,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:78688dc698b7dcfccefc07ae6fea6f8963cbdcbedad5796c4b13510d98e7ac73","observation_id":"88bf4f8e-b9b7-4af8-bacc-b6fe49955a1c","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-15T04:55:15.159462Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Open- vla: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:4a3f0af1f26c3dbeae58d51ba0c4c9f06adbc76839b5bd3a7ddb7004948cc764","observation_id":"ff837423-db9b-458f-814b-912b6dd4e200","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Perceiver-actor: A multi- task transformer for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:7b5e874ccd63725dc9fdf86d17f2be2ddf434179b3ef9605f7f9ca2b5e23ab88","observation_id":"e508af1e-fd0f-4275-879f-dae53ad9d63d","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Gnfactor: Multi-task real robot learning with generalizable neural feature fields,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:dd36a37a28b840871438b471233278d373ffdfb3cb6924a8215ffd3c5d03a16f","observation_id":"49333755-ed0a-4598-980a-1fbf953f2306","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Rvt: Robotic view transformer for 3d object manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:6b034f76583bac1237ab223d5dd99fbb2d958c33dbc6aa0eb5181343360318e3","observation_id":"388b40f9-956b-4e8c-b25e-dd8487f2aa2d","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Deformable detr: Deformable transformers for end-to-end object detection,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:ef8873655a2320e6c5e75dd0bcb2db04157ab1de774b3dbd964f33f530ba3b3a","observation_id":"bea649c3-5272-45c0-abcd-46ec540aa07b","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Bev- former: learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:6f9e5ba28d317fe2eace4ee6d8de8d205b5d504c48543eb72cc7aa655357265b","observation_id":"89974dad-0b5b-4722-8c1b-86cae44a48a9","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:5a76e049690514c5c464839d806d30f3ea352c54cddf647aac5dd62909bb15aa","observation_id":"308ba305-776a-4a59-bcb1-dfe04f5b19de","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Cvt-occ: Cost volume temporal fusion for 3d occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:3e2f38cfed573d2422a1dd7bb01c45bf6d256580797bcfd94f3d00dbc822cd63","observation_id":"fc0de2c0-a0f4-4aac-b32e-1d3093bab5f0","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:b46098f47eda1f4af7edf8f04bfcd2408eb5718afbd5a5fa965833ce139b66fb","observation_id":"f7fd6b00-9dba-42bb-ba90-6b13e2f598ee","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11297","last_updated":"2022-04-03T15:42:57Z","snapshot_observed_at":"2026-08-13T18:59:40.015343Z","submitted_at":"2021-06-21T17:55:59Z","title":"TokenLearner: What Can 8 Learned Tokens Do for Images and Videos?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11297","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Tokenlearner: What can 8 learned tokens do for images and videos?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2106.11297","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:a642b0a45a566653418b66658a6ee0fdbb41eb7327d15a8dd97f33ec9d89f790","observation_id":"165234c0-d7f8-4856-8725-9299041fa718","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02853","last_updated":"2025-05-13T03:02:42Z","snapshot_observed_at":"2026-08-13T12:26:50.058188Z","submitted_at":"2025-02-05T03:13:04Z","title":"Rethinking Latent Redundancy in Behavior Cloning: An Information Bottleneck Approach for Robot Manipulation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02853","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Rethinking latent redundancy in behavior cloning: An information bottleneck approach for robot manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2502.02853","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:81e2981a61be29cb2c12148fc29410c1f1a58d82af9aca1a59f5956f4665e574","observation_id":"030fcf50-ba7b-4039-983c-8cd44b776895","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Maniskill3: Gpu parallelized robot simulation and rendering for generalizable embodied ai,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:00986746fa05096b07d864e2fe788b30d79d5af30b02bc12b53746f90de571d1","observation_id":"af1251f1-af6d-41f1-b4da-b00684610ede","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-08-13T00:59:48.824306Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Libero-plus: In-depth robustness analysis of vision-language-action models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:ba60893a98021ee7315894df252b4e45ddccdce45fde69dbf3a64f17eb4ca28b","observation_id":"33971fa3-c89b-4c4a-ab5a-a9db8cd88a04","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Rdt-1b: a diffusion foundation model for bimanual manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:6d527fdf5d5ab0d5be5c706598ae1d5989080cc75ef297d4273e156488b8ee50","observation_id":"70223918-f4e2-48b3-b8d3-72d0a262af70","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05996","last_updated":"2024-07-08T14:46:44Z","snapshot_observed_at":"2026-08-14T13:19:27.920698Z","submitted_at":"2024-07-08T14:46:44Z","title":"Multimodal Diffusion Transformer: Learning Versatile Behavior from Multimodal Goals","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05996","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Multimodal diffusion transformer: Learning versatile behavior from multimodal goals,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2407.05996","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:1611f7c547afd6bae3c724be95ff898c672e783f2a0dcfa0e429a89a969df7c8","observation_id":"254afa48-c502-4b35-ae74-3827c9e0af7f","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Any-point trajectory modeling for policy learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:d5dd5800a42bdd5f3b33129928ff52eed4958d4a782e2a9d45a935f4779321e9","observation_id":"430c4597-8764-44ed-bc15-35fc2c792ea6","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Translating flow to policy via hindsight online imitation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:ee6f42f58cd81a37c35467f27933a47d6f9381bf25187321a6d1464fbc7f3fa2","observation_id":"72616562-f47a-40cd-9545-907c86ec6225","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:2b5ae7fff921118d8cafc590d1dcdca4ed38807e21f045e356b56a0198521488","observation_id":"e2f4bbe2-5260-491e-a60c-e171cdf3776b","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Vilt: Vision-and-language transformer without convolution or region supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:c047674abcc0e4e85b83c29023eb99de9b04ece203511b521ba3649b9e292220","observation_id":"df66a9df-45c6-4fb4-9892-bfeca83927d4","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-08-14T02:52:34.768729Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Galaxea open-world dataset and g0 dual-system vla model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:dbd376541ec489d85c702bb2f11cb160bbcb97ae8a5fd7b113c49652b62a852d","observation_id":"78ce29e0-7568-47db-a10d-2c37425db870","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T23:00:31.128534Z","title":"Gello: A general, low- cost, and intuitive teleoperation framework for robot manipulators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T23:00:31.128534Z"},"links":{"citing_paper":"/paper/2603.17720"},"observation_digest":"sha256:81fe68a1bef3255b32cc4e9b750f31c5992f2f139041679f527a6eb07d85bbf0","observation_id":"9b90a32b-a90c-4122-aa9e-f25139cb3fb4","resolution":{"observed_at":"2026-07-13T23:00:31.128534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.17720","last_updated":"2026-07-01T05:08:44Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T01:43:49.444896Z","submitted_at":"2026-03-18T13:40:24Z","title":"VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2603.17720."}