{"as_of":"2026-08-16T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:297a0cd21e0fa3a34c8dd3b7cba924a362bd0e35afb9dd4d6b9823dd35f93b31","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:35:40.151659Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06965/citation-record","integrity":"/paper/2608.06965/integrity","json":"/paper/2608.06965/citation-record.json","paper":"/paper/2608.06965"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-10T17:35:40.015659Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.015659Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:674949d500a2bfc6f1d9d67cb3f9e6251a0659e99bf42f03cb1cc7ef8070edf5","observation_id":"dbdf192e-1e12-4488-9e90-ca83130e4433","resolution":{"observed_at":"2026-08-10T17:35:40.015659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-10T17:35:40.021586Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.021586Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:73f2e7cae4f130cc89a7f591f5dbde51b73b270a354ddde94902b5e1d67cf55c","observation_id":"b1254549-1eba-47fb-824b-705bf8ef3555","resolution":{"observed_at":"2026-08-10T17:35:40.021586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.027289Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.027289Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:e5f2571e218d8b7de8d6b0574be399a619864065b6d5e7cfbee8242760fad631","observation_id":"ca0c98f5-0684-4f3b-b522-15ac046cd9f9","resolution":{"observed_at":"2026-08-10T17:35:40.027289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-10T17:35:40.032319Z","title":"Black, N","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.032319Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:4dade2d54b8a14cd13e46d6211ad626c278de88737b2fc6951b906e806509638","observation_id":"83f7faaa-371d-416d-ac08-0cb2e0ed29f0","resolution":{"observed_at":"2026-08-10T17:35:40.032319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-10T17:35:40.038135Z","title":"Intelligence, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.038135Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:347b156de2b20e3ce099eb36d2bac2007b6887a1f53dd8a03bf1e58fcb633da5","observation_id":"4b7e9d78-c891-4f21-83e7-de4af361e506","resolution":{"observed_at":"2026-08-10T17:35:40.038135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03685","last_updated":"2025-05-31T05:58:31Z","snapshot_observed_at":"2026-08-16T13:20:59.947719Z","submitted_at":"2024-09-05T16:39:21Z","title":"View-Invariant Policy Learning via Zero-Shot Novel View Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03685","snapshot_observed_at":"2026-08-10T17:35:40.044549Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.044549Z"},"links":{"cited_paper":"/paper/2409.03685","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:d2c093b555373f1efc1b9e432d6b101c5188894e88cdc8197491d8f7f9382051","observation_id":"c29208bc-0bd9-49a1-a2d8-b919ff4b54ec","resolution":{"observed_at":"2026-08-10T17:35:40.044549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-08-16T09:32:38.319890Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-10T17:35:40.050805Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.050805Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:c49f63bab110c3639fca4824fa0a8146a434163f3a5cdfb8bfc8c895f76ee62f","observation_id":"3a73d6c2-3d6e-4426-9dc6-fb8a13e61027","resolution":{"observed_at":"2026-08-10T17:35:40.050805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.056197Z","title":"Abouzeid, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.056197Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:779bcd8f55c017204d46d198abca160972d2bd54eedcd9eb60fe4fb4907235d0","observation_id":"c95a1f2f-f6c6-4fc5-ab8f-3e693dcfcaa4","resolution":{"observed_at":"2026-08-10T17:35:40.056197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07511","last_updated":"2025-03-10T16:32:41Z","snapshot_observed_at":"2026-08-16T12:51:26.734511Z","submitted_at":"2025-03-10T16:32:41Z","title":"PointVLA: Injecting the 3D World into Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07511","snapshot_observed_at":"2026-08-10T17:35:40.060996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.060996Z"},"links":{"cited_paper":"/paper/2503.07511","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:377daa72448fb4c4e87001e2d1324bc7905c1ad01390d5fc48ff749d1f007afa","observation_id":"dc8a69af-66f5-4b8d-a2b2-fbc63a2a63e3","resolution":{"observed_at":"2026-08-10T17:35:40.060996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:41.046763Z","title":null,"venue":null,"work_id":"a9a64d8e-30fc-4f5a-b552-c81181775463","year":null},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.066009Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:7313602e5ca8a5de11c6ae24cc57acebee0084d79c11327dac36a48f144341af","observation_id":"2497df80-ce59-465a-b6e8-11f9c51d6a9d","resolution":{"observed_at":"2026-08-10T17:35:41.051646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.076297Z","title":"Jiang, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.076297Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:15bded923609cf63dfb0c41dbadb6862fd6e1703269de07f404fd78fbf791a7a","observation_id":"e9d3125c-d1f0-4aa1-96ca-20030b068f5f","resolution":{"observed_at":"2026-08-10T17:35:40.076297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13103","last_updated":"2025-08-18T17:10:45Z","snapshot_observed_at":"2026-08-15T17:13:30.950680Z","submitted_at":"2025-08-18T17:10:45Z","title":"Grounding Actions in Camera Space: Observation-Centric Vision-Language-Action Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13103","snapshot_observed_at":"2026-08-10T17:35:40.081807Z","title":"Zhang, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.081807Z"},"links":{"cited_paper":"/paper/2508.13103","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:7b911ddc25bcc060dbb5adcddda22d5eaaf2011c2929ce58075662651299b7d1","observation_id":"3c5b2d5d-7484-41fd-b0d1-f98a5ad20c98","resolution":{"observed_at":"2026-08-10T17:35:40.081807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.087509Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.087509Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:cc46e592060779ac4b9ed3e64c23f0bc141d9740ee18196d8f9cb180d9290f76","observation_id":"18698cf7-5c24-4d44-92d4-2a1fea11a8d4","resolution":{"observed_at":"2026-08-10T17:35:40.087509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.092230Z","title":"Singh, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.092230Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:4e9fe7a79ce825d3486ae993f5e38f96074e239447bccd4a38b7964eaacce2d4","observation_id":"cd32bb4c-700a-4d6d-9e3d-1126d16201f5","resolution":{"observed_at":"2026-08-10T17:35:40.092230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.096880Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.096880Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:41c0e00dceb97ce121169fce10830fdf4b909daf569cf5b0a36e5877f8e2b0a4","observation_id":"b7b76642-1bae-4b12-9108-433bd0b40c92","resolution":{"observed_at":"2026-08-10T17:35:40.096880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-08-13T00:59:48.824306Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-08-10T17:35:40.101561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.101561Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:9816331eea411faccae8bf6cc22931e4ae5da7874613874285fb3bb948f468b2","observation_id":"c8d08d1f-1c65-4af7-a0a9-ead171e008b0","resolution":{"observed_at":"2026-08-10T17:35:40.101561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-08T17:26:38.829859Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-10T17:35:40.106472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.106472Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:763a07e3a43df5110e65220c68772571372caad8fcdb2a17006dba2c7dcb6b24","observation_id":"f4408f49-1c91-41aa-ac9c-751918990ad5","resolution":{"observed_at":"2026-08-10T17:35:40.106472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i14.33617","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.190154Z","title":"Zhang, Z","venue":null,"work_id":"7d1459d1-1efc-445a-ab9a-aa60dee3a64c","year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.111651Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:012f10b714f4c904823906de298b36798f9291460ba855a947257f5d7f32ad3f","observation_id":"f61f0bbd-f0ea-440e-b935-80c531f6e914","resolution":{"observed_at":"2026-08-10T17:35:40.197928Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.116324Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.116324Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:617a1cb67322e2b4ccb0dad8471f706a800405b9825be831b9d639930b8cb779","observation_id":"55a4a9f0-958f-480d-98a1-339ae280daa0","resolution":{"observed_at":"2026-08-10T17:35:40.116324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:41.018918Z","title":null,"venue":null,"work_id":"22f4a0cb-da0a-461f-b37b-e4af46e98050","year":2023},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.121108Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:532986006c435477262c536006966f10f3779e5b891f49a85e4a17d07ece2ef4","observation_id":"5a236d08-eca2-4786-b5ab-6aadcffc6ca9","resolution":{"observed_at":"2026-08-10T17:35:41.023945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:41.001890Z","title":null,"venue":null,"work_id":"99403fa2-5ca4-42c3-ba6c-3db2ec04e54a","year":2025},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.125661Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:a2582bf49063a83fe61fe2d34f70972ffdab59dc3952bcb0487c8fb467dfc1a1","observation_id":"06759173-1c2a-4616-a4cb-4bd3c1ff09e9","resolution":{"observed_at":"2026-08-10T17:35:41.007514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.987657Z","title":null,"venue":null,"work_id":"79ca6cce-4438-40fd-adbf-01e71fa5f9cd","year":2023},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.130654Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:207586831bc935d36ec5e77648c45ca21f16f684f4a4bb4165376da543a78661","observation_id":"f3a474b8-fe48-4c37-8e68-ee3007c76073","resolution":{"observed_at":"2026-08-10T17:35:40.992267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.972407Z","title":null,"venue":null,"work_id":"e05fcb91-1845-481b-9e9a-c9148b9bc78a","year":null},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.136041Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:4e2867d655549c3d5050f890388d2a98fa4c3c20328b229a6c7f9dcf343c2add","observation_id":"e746c1ad-74cc-40e7-8323-a96f4d2283dc","resolution":{"observed_at":"2026-08-10T17:35:40.977125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.957224Z","title":"Majumdar, K","venue":null,"work_id":"c2ace044-b211-4c84-9cb4-ac02d3c93ffe","year":2023},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.146507Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:01f8157b0f21e357e7cfeb27808d7c6f6f341532080909ff758f1c7db1083696","observation_id":"cc47273c-6b39-4ed4-ad5f-776b93ede1ab","resolution":{"observed_at":"2026-08-10T17:35:40.962316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.941812Z","title":"local surrogate","venue":null,"work_id":"62fe5fcb-d39e-4362-a7f0-9a9a46240d57","year":2023},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.151659Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:e158aedd9d72a595e509f58f3568dd09578c3b3fb7f054d434747889ebdc424a","observation_id":"f49e9792-a329-4f23-896e-1f11df4874a5","resolution":{"observed_at":"2026-08-10T17:35:40.946449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06173","last_updated":"2022-03-11T18:58:10Z","snapshot_observed_at":"2026-08-16T17:15:14.047305Z","submitted_at":"2022-03-11T18:58:10Z","title":"Masked Visual Pre-training for Motor Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06173","snapshot_observed_at":"2026-08-10T17:35:40.141026Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.141026Z"},"links":{"cited_paper":"/paper/2203.06173","citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:7546805419d1ccb0b032058137af5fc4a2cf37cc57f15ac1a4723eb4a079f95d","observation_id":"3f630eb6-b382-4a5f-ac9b-958160c3a46c","resolution":{"observed_at":"2026-08-10T17:35:40.141026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:35:40.071487Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T17:35:40.071487Z"},"links":{"citing_paper":"/paper/2608.06965"},"observation_digest":"sha256:ec5fea37076da93332d88249f539012b245dc4e2825ad40140c8cb5ec82ed13f","observation_id":"c23b312a-aa33-4d63-8465-d295bdf41b00","resolution":{"observed_at":"2026-08-10T17:35:40.071487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06965","last_updated":"2026-08-07T08:41:31Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T14:11:02.151355Z","submitted_at":"2026-08-07T08:41:31Z","title":"Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2608.06965."}