{"as_of":"2026-08-08T05:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c46f103ec8c21fd180b9c077a6f4c6948b7eda57861fd1cc29724af6703d4d9b","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:05:23.096610Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T00:57:42.384758Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T08:32:52.200905Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"cited_work":{"arxiv_id":"2507.06710","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06710","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a695d8da-2b41-4613-83c6-c56dd59ceb36","year":2025},"citing_paper":{"arxiv_id":"2604.15938","last_updated":"2026-04-17T10:56:59Z","snapshot_observed_at":"2026-07-31T03:34:07.969160Z","submitted_at":"2026-04-17T10:56:59Z","title":"VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T08:31:13.882275Z"},"links":{"cited_paper":"/paper/2507.06710","citing_paper":"/paper/2604.15938"},"observation_digest":"sha256:94ae7b3436340cbdbdb58fe8e6b7e92538c81670a564fd9fdd89e4b875739027","observation_id":"046e2022-f82b-403f-a99b-47f46f0a826b","resolution":{"observed_at":"2026-05-10T08:32:52.202593Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06710","snapshot_observed_at":"2026-08-02T00:57:42.384758Z","title":"Spatial- temporal aware visuomotor diffusion policy learning.arXiv preprint arXiv:2507.06710, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14852","last_updated":"2026-07-21T06:49:06Z","snapshot_observed_at":"2026-08-02T04:15:16.437644Z","submitted_at":"2026-07-16T11:22:06Z","title":"Towards Human-like Physical Intelligence: Lifelong Vision-Language-Action Learning for Robotic Manipulation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T00:57:42.384758Z"},"links":{"cited_paper":"/paper/2507.06710","citing_paper":"/paper/2607.14852"},"observation_digest":"sha256:2fae186cdde2c4e86a65701c69f07b1c941152a9666363d4d6ba45257355fd12","observation_id":"ad0e677d-ee68-4ae8-b596-9ab348fca764","resolution":{"observed_at":"2026-08-02T00:57:42.384758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.06710/citation-record","integrity":"/paper/2507.06710/integrity","json":"/paper/2507.06710/citation-record.json","paper":"/paper/2507.06710"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.153299Z","title":"Dexterous imitation made easy: A learning- based framework for efficient dexterous manipulation","venue":null,"work_id":"605df35a-c76a-4d85-abc8-8ae44fbdcf09","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.809255Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:eff37b458318f57f9cf0543a9f85d0ee9281b9139570ad5af5fb4e87fef3e82d","observation_id":"40bdbae0-1ef1-4345-99df-1ae9c991ac79","resolution":{"observed_at":"2026-08-06T19:05:24.158911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.136573Z","title":"Dexart: Benchmarking generalizable dexterous manipu- lation with articulated objects","venue":null,"work_id":"8e5c325f-179e-41b2-93ef-7ea0ce1aa342","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.814855Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:77a90acff4eb6f0b19f1395482ed8a1b622a4b1c20de14a1ebaa49b9ba77fa2e","observation_id":"b019af86-31a1-47cb-852a-ae4dc0df752b","resolution":{"observed_at":"2026-08-06T19:05:24.141932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.120323Z","title":"Decision transformer: Reinforce- ment learning via sequence modeling","venue":null,"work_id":"99f32c69-e9bf-44ba-ba3c-d4c54bdfb189","year":2021},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.819883Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:098a0ca761f465f0275227a81b4f33401b1d2332ba4b3755e1290a065a431553","observation_id":"78a5e56f-9e09-4979-8d46-8e7ffeb45f87","resolution":{"observed_at":"2026-08-06T19:05:24.125877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.104629Z","title":"Dif- fusiondet: Diffusion model for object detection","venue":null,"work_id":"3797f3b6-859b-4ea6-876f-c6d29ba57262","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.825362Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:13998c88f66b60bded6ccd204cc680205ca101cec27deade54581e411cfb0df0","observation_id":"189a05ee-e880-4386-84ea-bcccaaecac51","resolution":{"observed_at":"2026-08-06T19:05:24.109363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.088710Z","title":"Diffusion policy: Visuomotor policy learning via action dif- fusion","venue":null,"work_id":"2d0351d4-c916-4a43-a1c8-922336c9a507","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.830763Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:f50ba614d5c70e2996a65951565cbe6a615ed5f279fca1fa72a20df931345f28","observation_id":"f3f2f70c-b6af-4eb1-a990-74b13835d53a","resolution":{"observed_at":"2026-08-06T19:05:24.093676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.073062Z","title":"Bayesian imitation learning for end-to-end mo- bile manipulation","venue":null,"work_id":"03560649-05c1-463b-ac8f-f5dfc616d881","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.835524Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:6aadadd09665c9c39491171e2bffc3e994901366583c759ab6d4d848c33368b5","observation_id":"dbbe5a32-467e-44ff-a236-2cf955d18f00","resolution":{"observed_at":"2026-08-06T19:05:24.078046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.057226Z","title":"Implicit behavioral cloning","venue":null,"work_id":"d11dbf5b-5239-44eb-8072-79daeabecf49","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.845767Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:b0bd43398d93b9f737b20ffcb6fa89abe9a5410ed6455c192aa61322502a727f","observation_id":"d102b93c-2f92-4221-879d-23e1c5ab3b5f","resolution":{"observed_at":"2026-08-06T19:05:24.062135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.037208Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"c9240bd7-40e3-4276-9c9f-caf7ff1f015c","year":2018},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.851896Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:d1ad15c2f64dd2461e0ce16ce92affe34f115fcdbda59343d38e64af80b95ead","observation_id":"ec8d57b8-1d2a-48ae-8003-cc323dd01b5b","resolution":{"observed_at":"2026-08-06T19:05:24.043074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-06T19:05:22.857011Z","title":"Dream to control: Learning behaviors by la- tent imagination","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.857011Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:bd051d12e04270c5ee2af8bc27fd0a93e23633da253425396fb7b258700750d6","observation_id":"52a5574d-7060-449b-8a92-38fa1b4a07e6","resolution":{"observed_at":"2026-08-06T19:05:22.857011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-06T19:05:22.863439Z","title":"Mastering atari with discrete world models.arXiv preprint arXiv:2010.02193, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.863439Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:4436c78e17431df319416bd8c5a3d6de103e6dbbace49b7b783e0a1bd2fed3dc","observation_id":"140bdaf4-9e25-4aef-b1be-1a63f8edb186","resolution":{"observed_at":"2026-08-06T19:05:22.863439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.020840Z","title":"Deep hierarchical planning from pixels","venue":null,"work_id":"2c742cdc-fa7d-4a1e-82cb-9de57c9a828e","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.869160Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:705340a8cce0a9a665dfc2c807c6f617ee04450391d0dd54c49e653129691829","observation_id":"6b769cef-9df1-4a85-a090-7b5ca7bd1267","resolution":{"observed_at":"2026-08-06T19:05:24.025471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01497","last_updated":"2023-03-02T18:57:38Z","snapshot_observed_at":"2026-07-30T15:09:59.497278Z","submitted_at":"2023-03-02T18:57:38Z","title":"Teach a Robot to FISH: Versatile Imitation from One Minute of Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01497","snapshot_observed_at":"2026-08-06T19:05:22.876784Z","title":"Teach a robot to fish: Versatile imitation from one minute of demonstrations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.876784Z"},"links":{"cited_paper":"/paper/2303.01497","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:e14b8d6d76b4f29e6457180052a0e1fad2b329f533557038d3b8709a49105c26","observation_id":"2e83b270-c4ed-4180-8dd7-543bac9ffbde","resolution":{"observed_at":"2026-08-06T19:05:22.876784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05749","last_updated":"2023-06-15T17:57:21Z","snapshot_observed_at":"2026-08-04T07:39:34.440491Z","submitted_at":"2022-12-12T07:59:31Z","title":"On Pre-Training for Visuo-Motor Control: Revisiting a Learning-from-Scratch Baseline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05749","snapshot_observed_at":"2026-08-06T19:05:22.883748Z","title":"On pre-training for visuo-motor control: Re- visiting a learning-from-scratch baseline","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.883748Z"},"links":{"cited_paper":"/paper/2212.05749","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:c2f2fb664a9d6846501d0fb068b9f2f25a0637b42452f7b15b6d9374f394d078","observation_id":"aba1e13d-b87a-491e-9070-c3a91ef1deb1","resolution":{"observed_at":"2026-08-06T19:05:22.883748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:22.889716Z","title":"Video dif- fusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.889716Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a8477af3bf76192ed177058b912a598b7b6c7cd220d6b2d604940ab703a824de","observation_id":"c6dbbf63-d896-4bf7-b917-0fb91861c718","resolution":{"observed_at":"2026-08-06T19:05:22.889716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.993412Z","title":"Model-based imitation learning for urban driving","venue":null,"work_id":"db495f78-6fc4-4acc-9a69-c0bcdc45a8ea","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.894698Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:66997ff704ad723cb2dd70b057eb4ac1bf22d570362359bde730fe90de37686f","observation_id":"76c9f927-e42a-4bf5-bd6b-1e0477b43e3a","resolution":{"observed_at":"2026-08-06T19:05:23.998727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-06T19:05:22.899771Z","title":"Gaia-1: A generative world model for au- tonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.899771Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:1e8ab319fdbdb186941af24600d0f378f6c77d6af4ad79033bcff03ae1dd27ad","observation_id":"45d5829c-3782-498c-8b6c-7367b4315c8b","resolution":{"observed_at":"2026-08-06T19:05:22.899771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.972416Z","title":"Rlbench: The robot learning benchmark & learning environment","venue":null,"work_id":"5b3ec09e-3ba1-4995-9dbd-61671075c8ca","year":2020},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.905882Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:526ea6f3e98f08bbddad1f9a2938bf3710346417897c2a503a6cebcc2173548e","observation_id":"9f89b6e9-200f-44ec-88b8-4190af3bf9a6","resolution":{"observed_at":"2026-08-06T19:05:23.978023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.953578Z","title":"Coarse-to-fine imitation learning: Robot ma- nipulation from a single demonstration","venue":null,"work_id":"27f44e73-1af8-4bea-89a1-2770e15849c8","year":2021},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.910890Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a8bee650e0bf920e5f44937976619da1ff9ec7278b2e7b188d8919aabc83463c","observation_id":"13ff178a-0771-4214-83b5-4bab3dd43569","resolution":{"observed_at":"2026-08-06T19:05:23.959661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:22.915934Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.915934Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:5f6ef8d437a47b13d5c24ad47d5d84ecce39aa79bf6cd9e4beb0a0acc0249d29","observation_id":"0dad6769-74c0-4990-99b9-e74453985789","resolution":{"observed_at":"2026-08-06T19:05:22.915934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-06T19:05:22.923094Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.923094Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:01bb1e94cafdb3350c2af48d9c4418de126647ab094fc036e1d8387be81f95fd","observation_id":"8cbfe0a9-2907-4cd1-8555-8168076b6e49","resolution":{"observed_at":"2026-08-06T19:05:22.923094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.922970Z","title":"Gr-mg: Leveraging partially- annotated data via multi-modal goal-conditioned policy","venue":null,"work_id":"6cff763f-811e-40ca-8dca-8a6b0b5658c8","year":2025},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.928987Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:aebd425785da0ea99010ce3c9a480be9913f72945f49d337359b5e0465dab826","observation_id":"1f927ca1-3ae2-4cb4-b293-428cf7ba8f96","resolution":{"observed_at":"2026-08-06T19:05:23.927901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-06T19:05:22.934587Z","title":"Rdt-1b: a diffusion foundation model for bimanual manipu- lation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.934587Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:1bedef19cf8a035378e4313d02a784748d5bc72ca4093234fb7785baa5e01133","observation_id":"2aa3d729-62da-4e51-86db-8df1d1a14002","resolution":{"observed_at":"2026-08-06T19:05:22.934587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.906246Z","title":"Manigaussian: Dynamic gaus- sian splatting for multi-task robotic manipulation","venue":null,"work_id":"83d0543c-9f8c-47ed-a026-3582eb2831f2","year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.940850Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:e4a4f46a5b42b67595802f945e81abdd906bc1089708a1692027501a871ab5e9","observation_id":"ee7d5098-e9f8-4d66-8df4-b5195c03abe9","resolution":{"observed_at":"2026-08-06T19:05:23.911148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-06T19:05:22.945481Z","title":"What mat- ters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.945481Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:9c855032b0589fa318f9eed41ab0a0d5c84f98dbabfc666115673b4cc569904c","observation_id":"dba98471-0cc6-4704-9548-bb02e4741214","resolution":{"observed_at":"2026-08-06T19:05:22.945481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20109","last_updated":"2024-10-31T06:16:24Z","snapshot_observed_at":"2026-08-05T04:56:42.146574Z","submitted_at":"2024-07-29T15:36:42Z","title":"Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20109","snapshot_observed_at":"2026-08-06T19:05:22.950394Z","title":"Diffusion-dice: In-sample diffusion guid- ance for offline reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.950394Z"},"links":{"cited_paper":"/paper/2407.20109","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:3ea9e13194c36fbbe95e70fe051ba722cef69df0b30412dda0007dabffdb5686","observation_id":"0fd6699f-2736-421d-a743-d7ea00731f54","resolution":{"observed_at":"2026-08-06T19:05:22.950394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.00784","last_updated":"2020-07-21T00:59:24Z","snapshot_observed_at":"2026-07-06T09:09:18.723029Z","submitted_at":"2020-04-02T02:56:16Z","title":"Learning Agile Robotic Locomotion Skills by Imitating Animals","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.00784","snapshot_observed_at":"2026-08-06T19:05:22.955708Z","title":"Learning agile robotic locomotion skills by imitating animals","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.955708Z"},"links":{"cited_paper":"/paper/2004.00784","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:3ab0b6f5637f3f144598caeb9ad06ffeb32f83bcbec420beb30a32e3833bcd9e","observation_id":"69d2b0e8-ce36-4dcd-a3ae-c5d5ad740d81","resolution":{"observed_at":"2026-08-06T19:05:22.955708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.887720Z","title":"Dexmv: Imitation learning for dexterous manipulation from human videos","venue":null,"work_id":"1aba16dd-5220-4a16-b3b1-9ea864e6dfce","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.961156Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:3b8b4145f5f75f078543635575dde89a1e6cf90555ab3bb1aa5974f01fb568c8","observation_id":"be73476c-e88b-405b-8a43-c7eaa08dfb2d","resolution":{"observed_at":"2026-08-06T19:05:23.894738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.10087","last_updated":"2018-06-26T13:31:37Z","snapshot_observed_at":"2026-07-06T06:01:51.192687Z","submitted_at":"2017-09-28T17:51:13Z","title":"Learning Complex Dexterous Manipulation with Deep Reinforcement Learning and Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.10087","snapshot_observed_at":"2026-08-06T19:05:22.967479Z","title":"Learning complex dexterous manipulation with deep reinforcement learning and demonstrations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.967479Z"},"links":{"cited_paper":"/paper/1709.10087","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:faf7431a23910ad3a70e98e6aea17965752ea23bef3076233b3f7bb0cf67d0a8","observation_id":"186fcafb-bcba-4c27-a9f5-8effc120f8c8","resolution":{"observed_at":"2026-08-06T19:05:22.967479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T19:05:22.972562Z","title":"Proximal policy optimization algo- rithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.972562Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:0dde573bdc47a30db3dca879480ee65d90817698ad1c05fc092fbc3725304576","observation_id":"f4285f4b-1607-4ba7-905a-3445b37d521c","resolution":{"observed_at":"2026-08-06T19:05:22.972562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.864539Z","title":"Masked world models for visual control","venue":null,"work_id":"e848c294-1f43-4300-861a-de5f8e5dd8f1","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.976915Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:d25a2205028f8205c90f63808301456af58b383f2cf78565dda84cee7609e90f","observation_id":"ad9e2ebd-e571-4991-9634-abbb852c07f6","resolution":{"observed_at":"2026-08-06T19:05:23.872840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.834076Z","title":"Behavior transformers: Cloning k modes with one stone","venue":null,"work_id":"34712b50-b843-4a8a-a4ee-577fa769fd0b","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.982250Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:8dbba8d09a611f1195af3c77776b58389f2a633e84f9fee1d72ff58d92199341","observation_id":"867a84fd-f060-4793-a9bb-9e6266729869","resolution":{"observed_at":"2026-08-06T19:05:23.844903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16098","last_updated":"2023-11-27T18:59:25Z","snapshot_observed_at":"2026-07-30T21:15:46.584759Z","submitted_at":"2023-11-27T18:59:25Z","title":"On Bringing Robots Home","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16098","snapshot_observed_at":"2026-08-06T19:05:22.987266Z","title":"On bringing robots home","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.987266Z"},"links":{"cited_paper":"/paper/2311.16098","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:021be928664660b241618b6dff63d3d9d2bb39ca1d7c34741574b4544fcbfbb4","observation_id":"e864c6f7-987d-4d72-808c-cb8eac2069f8","resolution":{"observed_at":"2026-08-06T19:05:22.987266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:22.992010Z","title":"Perceiver- actor: A multi-task transformer for robotic manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.992010Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:671831c54fdf4a2d3f5ed51fe672cf30c40daafd6427691be050fb9b97d466ea","observation_id":"ee5206ba-4e57-4de2-92f5-3c3c709edf9e","resolution":{"observed_at":"2026-08-06T19:05:22.992010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T19:05:22.997333Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.997333Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:08fc055ad10ff204efd1bc4fb22019b2922d44b6fb91c47546de68ed2b839400","observation_id":"ba7cfe3d-5ff6-44d5-81a0-e3a79656c8ad","resolution":{"observed_at":"2026-08-06T19:05:22.997333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.805741Z","title":"Vrl3: A data-driven framework for visual deep reinforce- ment learning","venue":null,"work_id":"db187345-4aac-4808-bb44-ad6dd7f81dd9","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.002557Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:882e0958ee484bde42e578c470769b0569619fd7335ba0dd7007fc7422885dc9","observation_id":"e39fbab2-58d2-4557-826e-87ed4c5b7767","resolution":{"observed_at":"2026-08-06T19:05:23.811926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12422","last_updated":"2023-10-13T05:44:37Z","snapshot_observed_at":"2026-08-08T02:25:42.905263Z","submitted_at":"2023-02-24T02:54:15Z","title":"MimicPlay: Long-Horizon Imitation Learning by Watching Human Play","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12422","snapshot_observed_at":"2026-08-06T19:05:23.007925Z","title":"Mim- icplay: Long-horizon imitation learning by watching human play","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.007925Z"},"links":{"cited_paper":"/paper/2302.12422","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:7f46dcc663b04dd7be0d9d77e5df1f8a5f744c44c277d5a5407a250f26241550","observation_id":"cfbf36f3-7bc5-4e97-b8d8-77e92bee2224","resolution":{"observed_at":"2026-08-06T19:05:23.007925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.013140Z","title":"Drivedreamer: Towards real-world- drive world models for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.013140Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:29dce9cbd194e056e5c2a681afdd30448f7d474e3da67c20465b1fc7dcc65029","observation_id":"ccf48a71-b728-4331-bc86-0eb7bf636b32","resolution":{"observed_at":"2026-08-06T19:05:23.013140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.06193","last_updated":"2023-08-25T19:39:32Z","snapshot_observed_at":"2026-07-06T13:41:14.687081Z","submitted_at":"2022-08-12T09:54:11Z","title":"Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.06193","snapshot_observed_at":"2026-08-06T19:05:23.018513Z","title":"Dif- fusion policies as an expressive policy class for offline rein- forcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.018513Z"},"links":{"cited_paper":"/paper/2208.06193","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:cf56cd402389ad1136fd79bcec7511b5ca7d1338f85bb0844ffe3e875d82cf31","observation_id":"302007d0-04f9-4809-a204-cca0d10cb5ed","resolution":{"observed_at":"2026-08-06T19:05:23.018513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.024281Z","title":"4d gaussian splatting for real-time dynamic scene rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.024281Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:1b97017f449ffc4d48b34265481eb75180e989899afa9993dadd26827e3b5d3f","observation_id":"aa7573ba-6072-45d8-aefe-383d5d535984","resolution":{"observed_at":"2026-08-06T19:05:23.024281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.766503Z","title":"Daydreamer: World models for physical robot learning","venue":null,"work_id":"de20c9cf-3813-4cc9-9431-1ef733e6a0d0","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.029590Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:d3f276d27f2332b083d2d7d957a41261a89c3fd4aceec6609ddf7ae7e7626dd2","observation_id":"e597020f-d902-4434-b0f1-3d55aacdf061","resolution":{"observed_at":"2026-08-06T19:05:23.771881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13122","last_updated":"2023-05-22T15:23:41Z","snapshot_observed_at":"2026-08-06T08:45:25.937091Z","submitted_at":"2023-05-22T15:23:41Z","title":"Policy Representation via Diffusion Probability Model for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13122","snapshot_observed_at":"2026-08-06T19:05:23.036298Z","title":"Policy representation via diffusion prob- ability model for reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.036298Z"},"links":{"cited_paper":"/paper/2305.13122","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:d2d965e06ccf90ebe4e1fd4dd8d3b3a2df841067ac9967cfc4547bcd70b9a0c7","observation_id":"514be2b5-fe6c-4f71-a7a9-a1595c06c978","resolution":{"observed_at":"2026-08-06T19:05:23.036298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.751180Z","title":"Diffusion models: A comprehensive survey of methods and applications","venue":null,"work_id":"bc8380a1-cac3-4429-a582-0dbbd9eae3f2","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.042000Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:0a444a60bce9b9f4a55f49888a1d37c4e2ca586c9396dbd7b9e555512f31302c","observation_id":"46018c20-c352-4f65-83d2-ba5c8233baeb","resolution":{"observed_at":"2026-08-06T19:05:23.756437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01408","last_updated":"2025-05-04T22:44:25Z","snapshot_observed_at":"2026-08-01T08:44:40.684433Z","submitted_at":"2023-10-02T17:59:24Z","title":"Generalized Animal Imitator: Agile Locomotion with Versatile Motion Prior","version":3},"cited_work":{"arxiv_id":"2310.01408","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.01408","snapshot_observed_at":"2026-08-06T19:05:23.148817Z","title":"Generalized Animal Imitator: Agile Locomotion with Versatile Motion Prior","venue":"cs.RO","work_id":"7ff84b1c-0ef7-46d1-a785-5c316e44c81c","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.046703Z"},"links":{"cited_paper":"/paper/2310.01408","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:1bfc334523c0fdbd3960891cf5c5f6d278a14204b2eb221957fdca3c34ec919f","observation_id":"2d024925-1e77-490e-a327-1eecff378921","resolution":{"observed_at":"2026-08-06T19:05:23.158552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.734892Z","title":"Gnfactor: Multi-task real robot learning with generalizable neural feature fields","venue":null,"work_id":"79ff82d4-12dc-4f22-ae37-d0e4973cf944","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.053454Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:4352fba4becbdb1c2ce2f29227fce2e0b1668b2b31e4e51605cb5f55858048fb","observation_id":"370597b8-28e3-4fab-ac61-76e8c103ecf5","resolution":{"observed_at":"2026-08-06T19:05:23.739593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.713987Z","title":"3d diffusion policy: Gen- eralizable visuomotor policy learning via simple 3d repre- sentations","venue":null,"work_id":"052a4463-a974-4cc9-a499-e1259030799b","year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.059200Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:40b9ef6b5fd21fc83084cb85074133e8c757bf1a5898ac775cf8f261559af731","observation_id":"2bddd8dc-1365-4e6e-ae5d-e6c97e526787","resolution":{"observed_at":"2026-08-06T19:05:23.719358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.692099Z","title":"Point cloud matters: Rethinking the impact of different observation spaces on robot learn- ing","venue":null,"work_id":"102fece0-e570-4369-a8f5-b94a626d2ef9","year":2025},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.066548Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:79849658dcd06cf86a128ab70aac7d7bef0c17279c10e1d313f7dbe1f4a1f58f","observation_id":"c3391e5d-44fb-42c5-a3b1-e76318eaa31f","resolution":{"observed_at":"2026-08-06T19:05:23.698332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.662801Z","title":"Stacking Cups","venue":null,"work_id":"76194edc-16e9-45b9-b0e3-b6ed26bb8aa6","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.073236Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a8428f66bce39d9e174789ce72a9723e6113a3852bf96f9334fb1a1d94770658","observation_id":"87825247-7f05-48cc-afff-51d4d6ae94fe","resolution":{"observed_at":"2026-08-06T19:05:23.670794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.644926Z","title":"pointnet","venue":null,"work_id":"b3759eb9-61db-44ad-a5e9-43b71f281e03","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.082730Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:02986e893e4f95e355d4947a7b3c242e3b93b09be3057f284b3ca3a2af6cdbaa","observation_id":"2c829ac9-b042-45d9-9d6f-b9448988a646","resolution":{"observed_at":"2026-08-06T19:05:23.649837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.626574Z","title":"Grasping Bottles","venue":null,"work_id":"30377f38-d0a7-49fd-ac49-60a9f6f58dc7","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.090146Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:4ddd8525edd31877f6b0f0777b9387660e4caf06f903a02f9ca2a9997e358feb","observation_id":"5a2ab06e-8bf9-49bb-8ef0-6beeb483b05b","resolution":{"observed_at":"2026-08-06T19:05:23.633047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.610423Z","title":"grasping bottles","venue":null,"work_id":"004db442-457b-4a5d-8ac8-761be7f5b7a1","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.096610Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:08f6f36e3fa3f1141aa69dde8d6ef6f598b72e5d341ffb8eaacae2cd45cc9140","observation_id":"7d26c09c-48d4-468b-b9e0-5f1a41039ef9","resolution":{"observed_at":"2026-08-06T19:05:23.615125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T18:54:09.737742Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2507.06710."}