{"as_of":"2026-08-08T21:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97addc26d859700d426e4b2948e5839f3361d22184ef911caa867b3ed9457245","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":37,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T10:14:03.094179Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T11:09:47.137557Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2405.14093","last_updated":"2026-05-01T01:50:44Z","snapshot_observed_at":"2026-08-04T06:47:25.827167Z","submitted_at":"2024-05-23T01:43:54Z","title":"A Survey on Vision-Language-Action Models for Embodied AI","version":8},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-24T01:25:10.150459Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2405.14093"},"observation_digest":"sha256:b350827d22cc141ac73a25b2b33edff8f0839a8c51fec57631ef0e76bcbdbf91","observation_id":"92d89a72-64d1-4219-9271-03527209d67d","resolution":{"observed_at":"2026-05-24T01:25:54.400103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-05-16T08:25:17.847571Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2409.01652"},"observation_digest":"sha256:3224dae3599919868cae1070848dab7225f1db301fb6b8cf5413161ba92f4bee","observation_id":"72b44c2a-8ee5-4947-bc53-0bb1a4236322","resolution":{"observed_at":"2026-05-16T08:25:18.155563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2503.10631","last_updated":"2025-06-23T07:37:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-13T17:59:52Z","title":"HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-15T22:00:48.667428Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2503.10631"},"observation_digest":"sha256:af437dcc26e57e0379fbdf60cefcf2456447533926e05f7ca146fede4784b0f4","observation_id":"34408dfa-c2a4-4f6c-a993-97f374535d93","resolution":{"observed_at":"2026-05-15T22:00:48.857342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2505.03233","last_updated":"2025-08-27T03:43:58Z","snapshot_observed_at":"2026-08-07T00:53:01.614001Z","submitted_at":"2025-05-06T06:59:28Z","title":"GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T20:55:52.109166Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2505.03233"},"observation_digest":"sha256:54d83d6a79f9ccf56bb0d2e15a270b168ded7a4ea6ab9c0ce4506016fc0e9c49","observation_id":"772fc3a3-344c-4610-b0e8-83528891dc15","resolution":{"observed_at":"2026-05-17T20:55:52.311826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-07T13:35:51.083897Z","title":"Rvt-2: Learning precise manipulation from few demonstrations.arXiv preprint arXiv:2406.08545, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21652","last_updated":"2025-06-16T19:45:50Z","snapshot_observed_at":"2026-08-07T22:40:15.435997Z","submitted_at":"2025-05-27T18:25:42Z","title":"PartInstruct: Part-level Instruction Following for Fine-grained Robot Manipulation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.083897Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2505.21652"},"observation_digest":"sha256:658d592b0a7be6f6b361b763de4ad2c4cb3e0c04b5a306e04c991906cb9949a7","observation_id":"d668f55e-27f6-49d0-86f4-0446a1f7764e","resolution":{"observed_at":"2026-08-07T13:35:51.083897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-07T12:35:11.244743Z","title":"Rvt- 2: Learning precise manipulation from few demonstrations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24305","last_updated":"2025-06-20T13:07:10Z","snapshot_observed_at":"2026-08-08T15:01:56.456303Z","submitted_at":"2025-05-30T07:38:46Z","title":"SR3D: Unleashing Single-view 3D Reconstruction for Transparent and Specular Object Grasping","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:11.244743Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2505.24305"},"observation_digest":"sha256:2d5a1c872b153e18d1f9da518af0a99a8bc29e675670d0405417700472dceb71","observation_id":"648b9f1e-d370-4521-a736-8d4ac6cf26ab","resolution":{"observed_at":"2026-08-07T12:35:11.244743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-07T04:58:57.439596Z","title":"Rvt- 2: Learning precise manipulation from few demonstrations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":122,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:57.439596Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:3e595a3e1d4b3b0cfd93b8f0132cc504cd2ab7c692016300b47fcd1906848250","observation_id":"9af6af23-558a-4724-91aa-57665513bfb4","resolution":{"observed_at":"2026-08-07T04:58:57.439596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-07T04:56:52.346905Z","title":"Goyal, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09422","last_updated":"2025-06-11T06:11:49Z","snapshot_observed_at":"2026-08-08T19:28:05.060996Z","submitted_at":"2025-06-11T06:11:49Z","title":"Time-Unified Diffusion Policy with Action Discrimination for Robotic Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:56:52.346905Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2506.09422"},"observation_digest":"sha256:18165e22599cfe1c4204639564a3973e700283a852dd510f3b721ba832f66965","observation_id":"ef6faf59-d5d0-455e-ae1e-e3fbbccf8597","resolution":{"observed_at":"2026-08-07T04:56:52.346905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-07T04:17:08.566688Z","title":"Rvt-2: Learning precise manipulation from few demonstrations.arXiv preprint arXiv:2406.08545, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.566688Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:3cb2295ab87f25e94e3c9bcd0d8fadaa9400aa004c461126a4f632c50ecddcb3","observation_id":"d899cff8-9b08-4889-892e-3ab1332a6a6e","resolution":{"observed_at":"2026-08-07T04:17:08.566688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-07T00:31:31.765815Z","title":"Rvt-2: Learning precise manipulation from few demonstrations.arXiv preprint arXiv:2406.08545, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13679","last_updated":"2025-06-16T16:34:20Z","snapshot_observed_at":"2026-08-07T13:45:40.850146Z","submitted_at":"2025-06-16T16:34:20Z","title":"ROSA: Harnessing Robot States for Vision-Language and Action Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:31:31.765815Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2506.13679"},"observation_digest":"sha256:fe47cdf19fb3ffe4d06dd2961fe937cb9578c73fe0daff744cad23ade617f0a0","observation_id":"d15c9dcd-c39e-4e06-8e8d-338192f51988","resolution":{"observed_at":"2026-08-07T00:31:31.765815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-06T22:16:27.771773Z","title":"Available: https://arxiv.org/abs/2406.08545","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22028","last_updated":"2025-06-27T09:14:14Z","snapshot_observed_at":"2026-08-08T15:02:01.792652Z","submitted_at":"2025-06-27T09:14:14Z","title":"LMPVC and Policy Bank: Adaptive voice control for industrial robots with code generating LLMs and reusable Pythonic policies","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:16:27.771773Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2506.22028"},"observation_digest":"sha256:a7deb64c146bda8d925f41f6cf8b75e65b062303a846c3e3ebd7096edaf7b32a","observation_id":"b71824cb-9c54-4535-966c-d4269f8ab1e8","resolution":{"observed_at":"2026-08-06T22:16:27.771773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-06T22:04:28.087749Z","title":"Rvt-2: Learning precise manipulation from few demonstrations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22756","last_updated":"2025-06-28T05:03:31Z","snapshot_observed_at":"2026-08-07T11:45:09.405711Z","submitted_at":"2025-06-28T05:03:31Z","title":"RoboPearls: Editable Video Simulation for Robot Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:04:28.087749Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2506.22756"},"observation_digest":"sha256:f7839161b97548551f90422388b9e82fcee2578df45b0b3590b81ec8c5e18ebf","observation_id":"b1fd0c7b-1f30-4e11-ba3b-96f64e074111","resolution":{"observed_at":"2026-08-06T22:04:28.087749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-06T20:04:37.810336Z","title":"Rvt- 2: Learning precise manipulation from few demonstrations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03930","last_updated":"2025-07-08T01:07:30Z","snapshot_observed_at":"2026-08-07T12:49:17.624180Z","submitted_at":"2025-07-05T07:29:37Z","title":"RwoR: Generating Robot Demonstrations from Human Hand Collection for Policy Learning without Robot","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:04:37.810336Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2507.03930"},"observation_digest":"sha256:d3dcc1215d76fd8f53052881fdd39d9e2f2277bc58d37cb5ab08e8f6b71e5ac9","observation_id":"7f092340-47cb-49dd-8149-52271bf60658","resolution":{"observed_at":"2026-08-06T20:04:37.810336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-06T14:54:07.008032Z","title":"Rvt-2: Learn- ing precise manipulation from few demonstrations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17379","last_updated":"2025-07-23T10:23:15Z","snapshot_observed_at":"2026-08-08T15:02:00.249367Z","submitted_at":"2025-07-23T10:23:15Z","title":"Language-Conditioned Open-Vocabulary Mobile Manipulation with Pretrained Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:07.008032Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2507.17379"},"observation_digest":"sha256:c2320836920af8ded04baddc30214358441d80d636157e9aa338282fb8f49600","observation_id":"8050ad7d-523b-4d86-93e0-e793404528f7","resolution":{"observed_at":"2026-08-06T14:54:07.008032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-04T22:55:29.864667Z","title":"Rvt-2: Learning precise manipulation from few demonstrations.arXiv preprint arXiv:2406.08545, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06932","last_updated":"2025-09-10T14:34:25Z","snapshot_observed_at":"2026-08-07T11:30:34.307197Z","submitted_at":"2025-09-08T17:45:40Z","title":"LLaDA-VLA: Vision Language Diffusion Action Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T22:55:29.864667Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2509.06932"},"observation_digest":"sha256:1ec0249a4641852b56b44b094501a37f342b7a81f5d494ae9631adb68c128f7c","observation_id":"5dd79bc2-2a4c-4bfe-8968-c395034aee31","resolution":{"observed_at":"2026-08-04T22:55:29.864667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-04T09:34:42.480378Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14836","last_updated":"2026-06-09T10:47:44Z","snapshot_observed_at":"2026-08-05T03:01:04.996856Z","submitted_at":"2025-10-16T16:11:18Z","title":"QDepth-VLA: Quantized Depth Prediction as Auxiliary Supervision for Vision-Language-Action Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T09:34:42.480378Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2510.14836"},"observation_digest":"sha256:b80b7ba992e483e2710fd52769b32592c4c5e154ac32f0c295c13ae85f9d32d4","observation_id":"f5d8c324-d19e-4b68-8d1a-179175f0eb22","resolution":{"observed_at":"2026-08-04T09:34:42.480378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2603.05117","last_updated":"2026-07-30T06:55:05Z","snapshot_observed_at":"2026-08-02T23:16:32.480088Z","submitted_at":"2026-03-05T12:42:53Z","title":"SeedPolicy: Horizon Scaling via Self-Evolving Diffusion Policy for Robot Manipulation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T16:41:43.120491Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2603.05117"},"observation_digest":"sha256:d21cd90d97ae73345f822a8510ba062a2f1d3265d2f70deeb6f29aa9c290fbc5","observation_id":"21734492-4d2c-44c0-a411-c5bdd39f23e0","resolution":{"observed_at":"2026-05-15T16:46:18.367506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-02T18:47:52.115618Z","title":"Rvt-2: Learning precise manipulation from few demonstrations.arXiv preprint arXiv:2406.08545, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.05117","last_updated":"2026-07-30T06:55:05Z","snapshot_observed_at":"2026-08-02T23:16:32.480088Z","submitted_at":"2026-03-05T12:42:53Z","title":"SeedPolicy: Horizon Scaling via Self-Evolving Diffusion Policy for Robot Manipulation","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T18:47:52.115618Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2603.05117"},"observation_digest":"sha256:7dbbba37da2d788486b6b574c1d5ba342ad779d102c27e483ca5fef1a08e1412","observation_id":"26f64b6f-3fdd-4501-b684-d1fcd6565efa","resolution":{"observed_at":"2026-08-02T18:47:52.115618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2604.05672","last_updated":"2026-04-15T03:34:03Z","snapshot_observed_at":"2026-07-06T22:54:21.571606Z","submitted_at":"2026-04-07T10:18:40Z","title":"A1: A Fully Transparent Open-Source, Adaptive and Efficient Truncated Vision-Language-Action Model","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T19:31:23.255452Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2604.05672"},"observation_digest":"sha256:becbe7172328957c8dcf5bfcc95d51f2f13dedca51e262990ad472cf0e083ccd","observation_id":"e8b63eb7-349b-4815-a1f6-f11466ecd4d9","resolution":{"observed_at":"2026-05-10T22:50:51.360442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2604.10573","last_updated":"2026-04-12T10:36:18Z","snapshot_observed_at":"2026-08-02T12:13:25.467849Z","submitted_at":"2026-04-12T10:36:18Z","title":"Learning 3D Representations for Spatial Intelligence from Unposed Multi-View Images","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T15:44:39.322417Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2604.10573"},"observation_digest":"sha256:0e49d7a004193349fb328fed46fa92802f5342fab3c065c3d49d4357e824ee37","observation_id":"4dafde39-ed20-4ed5-9a63-f45c98a0d574","resolution":{"observed_at":"2026-05-11T09:56:03.538646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2605.01448","last_updated":"2026-05-02T13:55:28Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T13:55:28Z","title":"Decompose and Recompose: Reasoning New Skills from Existing Abilities for Cross-Task Robotic Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T14:30:00.890117Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2605.01448"},"observation_digest":"sha256:a9c6d88de8d4170bed4c657f1e83f78a79f0748d46ffe940268f5df6fd7d58ff","observation_id":"1d143ec3-3079-44a6-9afa-040637c04523","resolution":{"observed_at":"2026-05-11T16:56:06.880695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2605.21258","last_updated":"2026-05-20T14:48:01Z","snapshot_observed_at":"2026-08-02T04:19:09.664136Z","submitted_at":"2026-05-20T14:48:01Z","title":"Learning Structural Latent Points for Efficient Visual Representations in Robotic Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T03:46:30.726145Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2605.21258"},"observation_digest":"sha256:ca028d0ee7e3c64d420a8d34307c5c9522d23b7b32dd1e767ff1ba7b79cc14c5","observation_id":"9b1c4910-a101-4f9a-8bb6-8b8883f02bb7","resolution":{"observed_at":"2026-05-21T03:49:31.144493Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2605.21862","last_updated":"2026-05-21T01:19:17Z","snapshot_observed_at":"2026-07-06T23:32:15.891169Z","submitted_at":"2026-05-21T01:19:17Z","title":"EvoScene-VLA: Evolving Scene Beliefs Inside the Action Decoder for Chunked Robot Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T06:19:36.625269Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2605.21862"},"observation_digest":"sha256:d4c0b0b96be9a4c32043ef2519a1767c7ba3d502ad7ae01a25ac18bc2dff9e1b","observation_id":"890f44b6-bd64-44d4-98ae-386abc5485fd","resolution":{"observed_at":"2026-05-22T06:21:10.571277Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2605.24642","last_updated":"2026-05-23T16:18:41Z","snapshot_observed_at":"2026-07-30T07:41:42.487489Z","submitted_at":"2026-05-23T16:18:41Z","title":"Understanding the Impact of Geometric Foundation Models on Vision-Language-Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T13:40:59.330788Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2605.24642"},"observation_digest":"sha256:9052d47d3a13e6cd45203c5e39140103b37c62815bcd614b3fa7022680281a40","observation_id":"8890760d-dcd4-44eb-93be-b19449634373","resolution":{"observed_at":"2026-06-30T13:44:40.666008Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2605.25829","last_updated":"2026-05-25T13:28:33Z","snapshot_observed_at":"2026-08-02T07:58:35.491806Z","submitted_at":"2026-05-25T13:28:33Z","title":"OASIS: Observation-Action Space Alignment via SE(3) Trajectory Prediction for Robotic Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T21:27:26.682689Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2605.25829"},"observation_digest":"sha256:636173fbce0251e93c2fb25d3bb931c93623d61c6e8dfa146f1c028a366f9f77","observation_id":"b63d7f7b-e7cd-435b-9a3f-f6d4e7c6df84","resolution":{"observed_at":"2026-06-29T21:33:59.318499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2606.01072","last_updated":"2026-06-05T06:32:49Z","snapshot_observed_at":"2026-08-02T21:41:54.386640Z","submitted_at":"2026-05-31T07:34:25Z","title":"Expanding Spatial and Temporal Context for Robotic Imitation Learning With Scene Graphs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T17:24:02.843529Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2606.01072"},"observation_digest":"sha256:63d880ac0b3e6e33b4de7226deaae824d0c3cd6691cc66b5e8a1b2f6fb285842","observation_id":"f34c3245-fc32-42b7-b72a-d79344777402","resolution":{"observed_at":"2026-07-01T21:16:13.639321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2606.13394","last_updated":"2026-06-11T14:25:09Z","snapshot_observed_at":"2026-08-06T00:19:24.282471Z","submitted_at":"2026-06-11T14:25:09Z","title":"GeoHAT: Geometry-Adaptive Hybrid Action Transformer for Mobile Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T06:37:21.516021Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2606.13394"},"observation_digest":"sha256:a4f5ff0df170bba5f26494b88e1d94cc34ba3f48cc01d167dfb97a760ca97ec1","observation_id":"29733758-9525-44e8-ba60-a2c20277fca5","resolution":{"observed_at":"2026-07-03T15:18:33.013170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2606.13578","last_updated":"2026-06-11T17:03:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-11T17:03:53Z","title":"LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T06:53:49.349808Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2606.13578"},"observation_digest":"sha256:e434af2731c3ef972f319ea0752b6524352c7adb439108a6525f0f739c23ad2f","observation_id":"25f708af-30ca-4093-b3dd-e5cdb158ca1b","resolution":{"observed_at":"2026-07-03T14:48:33.527043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2606.20867","last_updated":"2026-06-18T18:54:51Z","snapshot_observed_at":"2026-08-03T13:52:03.831619Z","submitted_at":"2026-06-18T18:54:51Z","title":"FOCA: Future-Oriented Conditioning for Data-Efficient Vision-Language-Action Adaptation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-26T18:01:08.616612Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2606.20867"},"observation_digest":"sha256:97c71bc783b22c4ac758463784ec471b5bed94edb59145381261aec0f18ee3e6","observation_id":"50fedabc-79d4-47e7-a776-bec3a4f9f77a","resolution":{"observed_at":"2026-07-04T03:29:30.405210Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2606.21501","last_updated":"2026-06-19T14:53:40Z","snapshot_observed_at":"2026-07-30T13:23:20.103275Z","submitted_at":"2026-06-19T14:53:40Z","title":"UniviewVLA: A Unified Multiview Vision-Language-Action Model with World Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T14:27:40.585782Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2606.21501"},"observation_digest":"sha256:c983df01b0f4a57beb6be83eefeb98b670e69d2800bae9810afb423e40542da6","observation_id":"91c11564-544b-4e92-8e5c-c274b7ef6777","resolution":{"observed_at":"2026-07-04T06:29:37.529578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":"2406.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-04T11:09:47.137557Z","title":"RVT-2: learning precise manipulation from few demonstrations","venue":null,"work_id":"88df1da8-0634-4e47-898e-14226fa69a01","year":2024},"citing_paper":{"arxiv_id":"2606.23625","last_updated":"2026-06-22T17:19:57Z","snapshot_observed_at":"2026-07-06T23:58:20.975630Z","submitted_at":"2026-06-22T17:19:57Z","title":"Learning to See While Learning to Act: Diffusion Models for Active Perception in Robot Imitation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T08:08:48.779570Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2606.23625"},"observation_digest":"sha256:35d03a7f1e3e9e126a93ad961cc62cf33e70451dbc5ffe3b9cbe8bb2697bd2ae","observation_id":"77ee2454-065b-4261-a98a-49d7d7e25d01","resolution":{"observed_at":"2026-07-04T11:09:47.138818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-12T06:39:16.303751Z","title":"Rvt- 2: Learning precise manipulation from few demonstrations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02845","last_updated":"2026-07-03T00:48:44Z","snapshot_observed_at":"2026-08-06T11:39:36.467549Z","submitted_at":"2026-07-03T00:48:44Z","title":"Differential Amplifier-Inspired AmpAttention for Multi-View Robotic Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T06:39:16.303751Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2607.02845"},"observation_digest":"sha256:9bf1d1086586d2767418108a22bdf717c407940262e1f660390ec48a855448ac","observation_id":"f0493c65-8cc5-4602-a1c3-692fb8148344","resolution":{"observed_at":"2026-07-12T06:39:16.303751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-07-14T06:33:12.974578Z","title":"Goyal, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11167","last_updated":"2026-07-13T07:03:29Z","snapshot_observed_at":"2026-08-04T12:27:56.327233Z","submitted_at":"2026-07-13T07:03:29Z","title":"Pix2Act: Image-Space Manipulation Policies with Equivariant Augmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T06:33:12.974578Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2607.11167"},"observation_digest":"sha256:03dd6882771556f7a77cc9e86e82ee0743735afb6a13f275b3f0ac5b8fba15d2","observation_id":"42e0ea7a-3990-4a05-870e-30286fd4a555","resolution":{"observed_at":"2026-07-14T06:33:12.974578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-01T14:39:43.362949Z","title":"arXiv preprint arXiv:2406.08545 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18709","last_updated":"2026-07-22T05:33:17Z","snapshot_observed_at":"2026-08-08T18:57:26.098275Z","submitted_at":"2026-07-21T05:05:01Z","title":"RoboInter1.5: A Holistic Intermediate Representation Suite for Embodied World Modeling and Robotic Manipulation","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-01T14:39:43.362949Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2607.18709"},"observation_digest":"sha256:18f4e45c346206f62fc9360e0cc2407dd51a2d5d1215b3d9d4f95a42b17600e4","observation_id":"0d4ca4b8-f091-47fb-965c-85480e1fc7b8","resolution":{"observed_at":"2026-08-01T14:39:43.362949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-04T19:45:30.740135Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:30.740135Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:8f747e749866f911a49a7a5e6fa83b4017613546bfad0c2923670afdcf1c739f","observation_id":"65b4f476-755b-4eda-a1fd-d7e3ad97c85f","resolution":{"observed_at":"2026-08-04T19:45:30.740135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-06T20:19:48.095191Z","title":"Goyal, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04633","last_updated":"2026-08-05T09:49:02Z","snapshot_observed_at":"2026-08-08T20:11:58.177215Z","submitted_at":"2026-08-05T09:49:02Z","title":"Mind-VLA: Instruction-Aware Spatial Representation Alignment for Vision-Language-Action Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:19:48.095191Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2608.04633"},"observation_digest":"sha256:ba85db0293e289366410b25fa9d8d786760a04aab1d5c89de7dc37cd232cce53","observation_id":"3da0a491-2e47-4f1f-95f8-48f090164ce9","resolution":{"observed_at":"2026-08-06T20:19:48.095191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-08T10:14:03.094179Z","title":"Goyal, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05579","last_updated":"2026-08-06T04:00:07Z","snapshot_observed_at":"2026-08-08T20:16:17.272354Z","submitted_at":"2026-08-06T04:00:07Z","title":"ARGUS: Aligning Robot Scene Geometry Under Shifting Views with Large 3D Vision Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T10:14:03.094179Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2608.05579"},"observation_digest":"sha256:9d22003478d0a919c60b779f46221864f266f9e79e1c16f903a78d822c5b6df3","observation_id":"5693d143-f648-48bd-be85-4206f23a4a72","resolution":{"observed_at":"2026-08-08T10:14:03.094179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.08545/citation-record","integrity":"/paper/2406.08545/integrity","json":"/paper/2406.08545/citation-record.json","paper":"/paper/2406.08545"},"outbound":[],"paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T15:01:31.827555Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 37 inbound Pith citation observations for arXiv:2406.08545."}