{"as_of":"2026-08-16T07:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea5edb0bcd60470efca4f14e549563f0e15d5ac405297c0fc48dd4d82d3d661e","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:17:25.042562Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01066/citation-record","integrity":"/paper/2608.01066/integrity","json":"/paper/2608.01066/citation-record.json","paper":"/paper/2608.01066"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-15T15:17:24.819584Z","title":"arXiv preprint arXiv:2212.06817 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.819584Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:e8d40803a32e98da3c00fd12cff0d9c149439849c479243a25c71ea8b037e890","observation_id":"db8aecc5-7a34-4208-9000-1aaddb3ee5c4","resolution":{"observed_at":"2026-08-15T15:17:24.819584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.824246Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.824246Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:2cd32b97e1fee17a3063b121b4b5dda2ce3de102f64f4ad144c3813646a42ed5","observation_id":"0d200cf8-9c89-4d84-adaf-7848936d02bc","resolution":{"observed_at":"2026-08-15T15:17:24.824246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-15T04:55:15.159462Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-15T15:17:24.828113Z","title":"arXiv preprint arXiv:2406.09246 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.828113Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:0e77f6a2057e6c0f6d98955f014fe7529e3b9dd6786ad321e42b085aac9f52d0","observation_id":"c20ea2fb-9c20-43e1-8e77-ced60fe91dec","resolution":{"observed_at":"2026-08-15T15:17:24.828113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-08-15T09:35:08.116329Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-15T15:17:24.832579Z","title":"arXiv preprint arXiv:2502.19645 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.832579Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:141d0493a898b9bee71980a5c6600bd15e697144ce9f8bea476bb408cf46ef38","observation_id":"156d272c-b8d2-46cc-9adb-58f9b52b0aed","resolution":{"observed_at":"2026-08-15T15:17:24.832579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.837157Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.837157Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:677549886a835cdab4436880454f958db8b6e0fce7a498b3daed8bcabe49f86f","observation_id":"52154e12-9188-4144-a25b-4b23ed89226b","resolution":{"observed_at":"2026-08-15T15:17:24.837157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.841273Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.841273Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:1274ed7189a1d932947f0b31903bf59ff4d03dfbc5f312b7fa6818183237c800","observation_id":"05d2dbb0-e2ae-447c-854d-86328ee6b871","resolution":{"observed_at":"2026-08-15T15:17:24.841273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:26.133299Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"100fa3e5-94c4-4a66-89fc-1e559a84f6a1","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.845042Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:6ae8c7cef4daeed346979490842aaef56bd5a3db6073eba3f25010cf9a4c985e","observation_id":"f5a708b4-4a31-4bc5-af9a-8cd800fe4c73","resolution":{"observed_at":"2026-08-15T15:17:26.136847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:26.121408Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"14d84bf7-292f-4fd4-ab6a-1a8d7c78282a","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.849300Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:dedd80ce6e68d160ff02675e331964ccfd3bae5ccabbcaa083a546d6ffb2cdeb","observation_id":"1a4c1bdd-ec32-4615-aa4e-e74f15eb1fd7","resolution":{"observed_at":"2026-08-15T15:17:26.125242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-15T15:17:24.853472Z","title":"arXiv preprint arXiv:2405.12213 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.853472Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:c03a98d432ca254801e02acf30a2909a9d230ea5370bf43dbdade490b5072024","observation_id":"f21b451e-f215-4372-a574-d9dde28f5496","resolution":{"observed_at":"2026-08-15T15:17:24.853472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.857513Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.857513Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:6114e53d4a7764e3fee19f33f02b8f4b66d657c4b4bb25db83d6f24a8800b425","observation_id":"065c5e25-dc69-4842-850e-9d4e3da16853","resolution":{"observed_at":"2026-08-15T15:17:24.857513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-15T15:17:24.861254Z","title":"arXiv preprint arXiv:2501.09747 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.861254Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:4be8ac2f94757941ab737dec3dde50febf02607a4d654724399124d031da2da7","observation_id":"5c831e4e-a1f4-4c5f-afb4-f4ed9f2e3b2b","resolution":{"observed_at":"2026-08-15T15:17:24.861254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-15T15:17:24.865111Z","title":"arXiv preprint arXiv:2503.14734 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.865111Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:c6b0ba77296720587ad3b9f7981ec2e2f12eee17e64de1c3987fdb72042d0f93","observation_id":"a910a30f-9116-4a9a-9f10-8799cd0030f9","resolution":{"observed_at":"2026-08-15T15:17:24.865111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-15T15:17:24.869179Z","title":"arXiv preprint arXiv:2505.06111 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.869179Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:2165b66c939e0783130f9311a084ca9c5c1ada78ab50c5786f76e7338bbacc95","observation_id":"ec0ffe6d-ce28-4e37-9430-5f303fe44dab","resolution":{"observed_at":"2026-08-15T15:17:24.869179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-08-13T11:17:54.365190Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-15T15:17:24.873140Z","title":"arXiv preprint arXiv:2506.01844 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.873140Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:f6472111cf3147927caf0b890902dfbab836e7335f0a213056e6660feffa18bf","observation_id":"1c2cba11-2479-4a52-b954-f9ed5d421f46","resolution":{"observed_at":"2026-08-15T15:17:24.873140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.877134Z","title":"arXiv preprint arXiv:2510.02268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.877134Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:e0ea2350713192cd382566d540ee8df38346b30612e563028b6e0a623490d3d6","observation_id":"2ad1142e-599c-48b3-badc-46f6c432a3c5","resolution":{"observed_at":"2026-08-15T15:17:24.877134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:26.101559Z","title":null,"venue":null,"work_id":"2e3f1b1a-7b6a-40df-8956-956c66a2ec1a","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.881014Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:0c68674f592c0a0e9dc568d18719f9996ecb83888b37019662832a8eb4229254","observation_id":"bb0705ae-5159-4946-a600-4a52276c3364","resolution":{"observed_at":"2026-08-15T15:17:26.105035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-14T06:27:35.193223Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2607.11498","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.11498","snapshot_observed_at":"2026-08-15T15:17:25.794945Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","venue":"cs.RO","work_id":"904883c1-0aa7-4c2d-b461-aed540788bb8","year":2026},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.885816Z"},"links":{"cited_paper":"/paper/2607.11498","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:35394c3d0c5ced602271708e55422858a6fd4395e30dedc37b9911e5e89276fb","observation_id":"43e68c58-2689-4fac-8d96-c62ce7336aae","resolution":{"observed_at":"2026-08-15T15:17:25.798776Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05396","last_updated":"2026-07-06T17:59:59Z","snapshot_observed_at":"2026-08-15T07:57:58.932187Z","submitted_at":"2026-07-06T17:59:59Z","title":"From Fixed to Free Cameras: Calibration-Free View-Robust Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2607.05396","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.05396","snapshot_observed_at":"2026-08-15T15:17:25.775950Z","title":"From Fixed to Free Cameras: Calibration-Free View-Robust Vision-Language-Action Model","venue":"cs.CV","work_id":"39a70d23-54a4-49aa-a6cc-23e7c89c4334","year":2026},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.889788Z"},"links":{"cited_paper":"/paper/2607.05396","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:8543f06d0b2c876b961c9afaa7aa129ed726203c0b42ec787f30af9f0cd4d4df","observation_id":"a5a18408-ff58-4f99-ae57-76693c871cf7","resolution":{"observed_at":"2026-08-15T15:17:25.781701Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03685","last_updated":"2025-05-31T05:58:31Z","snapshot_observed_at":"2026-08-12T22:50:32.834929Z","submitted_at":"2024-09-05T16:39:21Z","title":"View-Invariant Policy Learning via Zero-Shot Novel View Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03685","snapshot_observed_at":"2026-08-15T15:17:24.893848Z","title":"arXiv preprint arXiv:2409.03685 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.893848Z"},"links":{"cited_paper":"/paper/2409.03685","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:c3dc5a15bc059b3825a92109dd30635ca43e63686c00919402de648245088362","observation_id":"9b2e7259-708d-4592-8bad-051174f11355","resolution":{"observed_at":"2026-08-15T15:17:24.893848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.898076Z","title":"arXiv preprint arXiv:2603.29192 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.898076Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:528764dc19ebf46b27a287185335102c2645ca5129a014e4836c56ebc9ccdc1b","observation_id":"89a6a08b-b0ca-4d14-8c7a-88bb1dd5981b","resolution":{"observed_at":"2026-08-15T15:17:24.898076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.902090Z","title":"arXiv preprint arXiv:2603.26757 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.902090Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:5d0575f99cac60740940b396d1a300956ef3068df6c6e9da1e850a3b8427cb62","observation_id":"4900c650-0edb-4ea7-a20d-f5e6ef1b380c","resolution":{"observed_at":"2026-08-15T15:17:24.902090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05868","last_updated":"2026-08-10T08:43:57Z","snapshot_observed_at":"2026-08-13T23:38:00.331809Z","submitted_at":"2026-03-06T03:44:23Z","title":"AnyCamVLA: Zero-Shot Camera Adaptation for Viewpoint Robust Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.05868","snapshot_observed_at":"2026-08-15T15:17:24.905887Z","title":"arXiv preprint arXiv:2603.05868 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.905887Z"},"links":{"cited_paper":"/paper/2603.05868","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:1f3b939b9a7ca5c38f0229927675d72857483eedb9e8e333e10d4134645147b7","observation_id":"b0e874a1-08a7-4798-9825-e6f8a44201ca","resolution":{"observed_at":"2026-08-15T15:17:24.905887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:26.089209Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"97f43865-a616-471b-bf17-543e76270100","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.910540Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:02684a8e7251c1d73287b8ece4e2eb0f09bdd4cbfb631381b518de0a1c24cd1a","observation_id":"3b51ec04-e8ab-421a-a7ae-b9b96e6254b7","resolution":{"observed_at":"2026-08-15T15:17:26.093167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21914","last_updated":"2026-04-23T17:57:13Z","snapshot_observed_at":"2026-08-13T08:34:04.703373Z","submitted_at":"2026-04-23T17:57:13Z","title":"VistaBot: View-Robust Robot Manipulation via Spatiotemporal-Aware View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21914","snapshot_observed_at":"2026-08-15T15:17:24.914691Z","title":"arXiv preprint arXiv:2604.21914 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.914691Z"},"links":{"cited_paper":"/paper/2604.21914","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:257dd70b6a49541ad19bf63188ce2c404fc96a7ddad46ddefaada1cd15bc656e","observation_id":"437cdb23-d956-4e5f-95d4-b7bd043e5bbd","resolution":{"observed_at":"2026-08-15T15:17:24.914691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.918815Z","title":"IEEE transactions on pattern analysis and machine intelligence , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.918815Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:bc8c6041836742de791dfcb2a35f401d9f41f7dbdac54ad2ddf365e5ef760e1e","observation_id":"b26a1aa8-97ea-4376-9974-1812083e3259","resolution":{"observed_at":"2026-08-15T15:17:24.918815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.922628Z","title":"Proceedings of the IEEE/CVF international conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.922628Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:ec7347291bad5f7f937ce1ccfeadfd06fae84fc966183d23fcd7fb22fd78c6f2","observation_id":"fffc178f-030d-4034-89b1-47f70c8c45af","resolution":{"observed_at":"2026-08-15T15:17:24.922628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.926359Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.926359Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:5aa99512f67092c93ebc6451f4f37476c79333ca0eb7efe5cc3ee5af6a88773a","observation_id":"68dd704c-23cd-4ff2-80e2-210604a8ea4c","resolution":{"observed_at":"2026-08-15T15:17:24.926359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.930086Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.930086Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:2375cb243f20177639f9aaa7641e83b13ae297b149c0f1f220b45fdb4f7ef57a","observation_id":"4b703d28-b58d-4ba3-9e9e-0d3cf9fd85e1","resolution":{"observed_at":"2026-08-15T15:17:24.930086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:26.046622Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"dd7a1f0e-c4f8-4d74-b767-2e7bbf74c5eb","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.933486Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:68943f53fb1825b3de0ad8461effb96e34cf43be144091b2c1d727966893162e","observation_id":"1e151315-fffb-4c49-9fe9-1b0727130ef3","resolution":{"observed_at":"2026-08-15T15:17:26.050522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.938014Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.938014Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:df632a6e11f8829832cad8ce738c7f76104390571178c1ab327a42f9241b0a08","observation_id":"69825178-b9e1-440f-bb16-7ee972bb5a98","resolution":{"observed_at":"2026-08-15T15:17:24.938014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15959","last_updated":"2025-03-23T05:03:59Z","snapshot_observed_at":"2026-08-15T22:03:06.498422Z","submitted_at":"2024-10-21T12:43:54Z","title":"Diffusion Transformer Policy","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15959","snapshot_observed_at":"2026-08-15T15:17:24.942121Z","title":"arXiv preprint arXiv:2410.15959 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.942121Z"},"links":{"cited_paper":"/paper/2410.15959","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:b62957f28f8cc4cdf20f450ed6c83095254107023b41c4ae14f83112bb7c1894","observation_id":"5926974d-43dd-4ea0-9f82-f12426a5068b","resolution":{"observed_at":"2026-08-15T15:17:24.942121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.946497Z","title":"The International Journal of Robotics Research , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.946497Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:1dd61baab7a0ed4d3c5c2e3432a4fee36eb73ebb6f79b857b39798149d7452d1","observation_id":"5abb34d6-f4c7-49dc-877b-533fea2d066e","resolution":{"observed_at":"2026-08-15T15:17:24.946497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.15330","last_updated":"2026-07-22T11:38:14Z","snapshot_observed_at":"2026-08-14T18:04:53.379466Z","submitted_at":"2026-07-16T16:02:25Z","title":"Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.15330","snapshot_observed_at":"2026-08-15T15:17:24.951028Z","title":"arXiv preprint arXiv:2607.15330 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.951028Z"},"links":{"cited_paper":"/paper/2607.15330","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:fe7f3bdef0e6429e8fc717c1bf5b27acad0ff9846e7e57d20bd343adf2281ef0","observation_id":"93313b23-be72-440b-899f-91968f484b7d","resolution":{"observed_at":"2026-08-15T15:17:24.951028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-06T21:08:13.002956Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06403","snapshot_observed_at":"2026-08-15T15:17:24.954806Z","title":"arXiv preprint arXiv:2607.06403 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.954806Z"},"links":{"cited_paper":"/paper/2607.06403","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:df4ac9b2cad03c9a98977b90095e949b9571fedb4826729620f86d214e643d91","observation_id":"1da9a5a6-7138-4126-b25e-e09a868d0d89","resolution":{"observed_at":"2026-08-15T15:17:24.954806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.17977","last_updated":"2026-07-31T13:34:17Z","snapshot_observed_at":"2026-08-13T16:53:07.614122Z","submitted_at":"2026-07-20T14:13:27Z","title":"RynnBrain 1.1: Towards More Capable and Generalizable Embodied Foundation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.17977","snapshot_observed_at":"2026-08-15T15:17:24.958690Z","title":"arXiv preprint arXiv:2607.17977 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.958690Z"},"links":{"cited_paper":"/paper/2607.17977","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:6acaa172d218bcc08443fcb3118bb4375c3577b14fea99360711e94e42a1b61f","observation_id":"a2aaa785-8eac-423a-880d-fd0f88662bcb","resolution":{"observed_at":"2026-08-15T15:17:24.958690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17846","last_updated":"2026-06-17T17:06:39Z","snapshot_observed_at":"2026-08-01T08:00:11.218777Z","submitted_at":"2026-06-16T12:14:39Z","title":"Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.17846","snapshot_observed_at":"2026-08-15T15:17:24.962628Z","title":"arXiv preprint arXiv:2606.17846 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.962628Z"},"links":{"cited_paper":"/paper/2606.17846","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:0a9533f1d08dea4e3e84401518c91b967a2ecf9484a3314101dea49058c9006b","observation_id":"3182da73-4e60-4124-be82-3920b472a4c3","resolution":{"observed_at":"2026-08-15T15:17:24.962628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30280","last_updated":"2026-06-01T13:48:35Z","snapshot_observed_at":"2026-08-04T01:13:02.026321Z","submitted_at":"2026-05-28T17:36:31Z","title":"Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30280","snapshot_observed_at":"2026-08-15T15:17:24.966792Z","title":"arXiv preprint arXiv:2605.30280 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.966792Z"},"links":{"cited_paper":"/paper/2605.30280","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:c3ff71816f66248809b2981e1d6753fafbfe26dba91151cb8af7885c49b79123","observation_id":"85d7d2c4-b324-4a53-bc81-f49d52773011","resolution":{"observed_at":"2026-08-15T15:17:24.966792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11236","last_updated":"2026-04-14T10:01:08Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:47:01Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.11236","snapshot_observed_at":"2026-08-15T15:17:24.970741Z","title":"arXiv preprint arXiv:2602.11236 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.970741Z"},"links":{"cited_paper":"/paper/2602.11236","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:17b3485fbf3838e8f1e668c007739dade5e80bc4f5da1db9694036d589a324e0","observation_id":"a8c06094-8ba4-4320-ab31-5520a37f488d","resolution":{"observed_at":"2026-08-15T15:17:24.970741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.04988","last_updated":"2026-07-06T12:25:30Z","snapshot_observed_at":"2026-08-13T01:19:23.220499Z","submitted_at":"2026-07-06T12:25:30Z","title":"InternVLA-A1.5: Unifying Understanding, Latent Foresight, and Action for Compositional Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04988","snapshot_observed_at":"2026-08-15T15:17:24.974430Z","title":"5: Unifying Understanding, Latent Foresight, and Action for Compositional Generalization , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.974430Z"},"links":{"cited_paper":"/paper/2607.04988","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:a12611aa7673095ec315d4b51b73734ec93da36b6eb3b8f0a72b02f6bf9f676b","observation_id":"f0b671c0-b12d-44a9-a560-2baf12fafbf8","resolution":{"observed_at":"2026-08-15T15:17:24.974430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.04426","last_updated":"2026-07-05T17:43:06Z","snapshot_observed_at":"2026-08-12T13:31:45.799876Z","submitted_at":"2026-07-05T17:43:06Z","title":"ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04426","snapshot_observed_at":"2026-08-15T15:17:24.978338Z","title":"arXiv preprint arXiv:2607.04426 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.978338Z"},"links":{"cited_paper":"/paper/2607.04426","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:cce14c953895fe6abe6ad9416948310bddbefaa357e82f4628ef8c6417593118","observation_id":"552d0570-b757-4edb-867b-e7857617e555","resolution":{"observed_at":"2026-08-15T15:17:24.978338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.982433Z","title":"arXiv preprint arXiv:2510.11027 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.982433Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:7e4ed1e80666daa68d2e3baaebb39261f73ebfda5011e8867afca5fda34a9893","observation_id":"462acba9-5b56-4894-8b31-4f7febdda2f5","resolution":{"observed_at":"2026-08-15T15:17:24.982433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:26.019161Z","title":"8th Annual Conference on Robot Learning , year=","venue":null,"work_id":"97bffda5-0f75-4776-a1bb-a397da714f0b","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.986016Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:49876de4451161fd043de47b7ea63a49a13feea1ab4cbe45d50934379a669c0e","observation_id":"7b0aacf8-0ff5-4d32-ae8a-010f820c561a","resolution":{"observed_at":"2026-08-15T15:17:26.022914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.989405Z","title":"arXiv preprint arXiv:2509.22578 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.989405Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:45343da0d46b3a5dde7e7107a1ef9c0936cb7d351ea3c112637b07e6295d1be0","observation_id":"f0c01e8f-ec78-488a-a1de-11cc66808e4d","resolution":{"observed_at":"2026-08-15T15:17:24.989405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:24.993155Z","title":"arXiv preprint arXiv:2601.09605 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.993155Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:6035ebcf277a07602866ff7e7fb62bfeb30ecaf9cfe83f8e77ca1019daec468b","observation_id":"395382bb-3f35-411e-ad2f-a4354b752ce4","resolution":{"observed_at":"2026-08-15T15:17:24.993155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-15T15:17:24.997073Z","title":"arXiv preprint arXiv:2501.15830 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:24.997073Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:794ac97fe7faf5f91dd9b8f5b6f4fb466d4b75ddf3cfb8ebbd9f498fd5233734","observation_id":"323d6dbf-463b-4940-ba06-2eff51a8dd8a","resolution":{"observed_at":"2026-08-15T15:17:24.997073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01479","last_updated":"2024-10-29T17:49:41Z","snapshot_observed_at":"2026-08-12T23:31:05.860274Z","submitted_at":"2024-07-01T17:09:43Z","title":"EquiBot: SIM(3)-Equivariant Diffusion Policy for Generalizable and Data Efficient Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01479","snapshot_observed_at":"2026-08-15T15:17:25.000984Z","title":"arXiv preprint arXiv:2407.01479 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.000984Z"},"links":{"cited_paper":"/paper/2407.01479","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:8b3d2096a4ab1b791e33b0b395423db311563581f27ae22bdb9eb690f9410896","observation_id":"6a6e7574-3330-4223-92d0-1033b83703b2","resolution":{"observed_at":"2026-08-15T15:17:25.000984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:26.007461Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"30428830-2f44-4a08-81c4-915bc5c59ecf","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.004931Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:f502baf1629afd9f21563d91763905c74172983a1d74ad44a7a8a8e145e4222c","observation_id":"c76bad69-887d-4b16-831d-795a025f8a87","resolution":{"observed_at":"2026-08-15T15:17:26.011158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18623","last_updated":"2024-12-14T18:38:03Z","snapshot_observed_at":"2026-08-12T10:57:30.698813Z","submitted_at":"2024-11-27T18:59:52Z","title":"Lift3D Foundation Policy: Lifting 2D Large-Scale Pretrained Models for Robust 3D Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18623","snapshot_observed_at":"2026-08-15T15:17:25.008641Z","title":"arXiv preprint arXiv:2411.18623 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.008641Z"},"links":{"cited_paper":"/paper/2411.18623","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:3748b67b0170da0370e22f751999232bda63a777ab80c77d93f5861b80a6e689","observation_id":"a713bb24-c1f7-42ba-b4a2-c933a84fa6e6","resolution":{"observed_at":"2026-08-15T15:17:25.008641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:25.013291Z","title":"arXiv preprint arXiv:2601.08325 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.013291Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:b37b9d07fe18b64ad9951f29033072ecc1acdeca24a05294d27f7f36b00bcb4a","observation_id":"b786de34-a5ce-45ef-90f5-674260b58d48","resolution":{"observed_at":"2026-08-15T15:17:25.013291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04659","last_updated":"2023-02-09T14:24:01Z","snapshot_observed_at":"2026-08-13T12:48:04.952035Z","submitted_at":"2023-02-09T14:24:01Z","title":"ManiSkill2: A Unified Benchmark for Generalizable Manipulation Skills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04659","snapshot_observed_at":"2026-08-15T15:17:25.016920Z","title":"arXiv preprint arXiv:2302.04659 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.016920Z"},"links":{"cited_paper":"/paper/2302.04659","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:77b1b2686ec53a3438998ebb6c184ae48ab79a5fea72b9211025050cefe3eb23","observation_id":"8ab18955-a083-44b5-83a5-65eef5f76a07","resolution":{"observed_at":"2026-08-15T15:17:25.016920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-15T15:17:25.020740Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.020740Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:69aa9e6bac3d5ec91e37a19683753f7a3ad50de4b54b0e1276d42bd873d0a5e7","observation_id":"b080f973-8158-46af-ab0e-da915078c32e","resolution":{"observed_at":"2026-08-15T15:17:25.020740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:25.025031Z","title":"arXiv preprint arXiv:2509.15733 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.025031Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:1d9210c69bb4b0879eab39c50fcb303e8bb34f6ff1cf3daf329239b45731483e","observation_id":"1ceba376-6c71-4589-8785-0398bf6ad495","resolution":{"observed_at":"2026-08-15T15:17:25.025031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10885","last_updated":"2024-07-25T14:30:22Z","snapshot_observed_at":"2026-07-06T17:31:17.058043Z","submitted_at":"2024-02-16T18:43:02Z","title":"3D Diffuser Actor: Policy Diffusion with 3D Scene Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10885","snapshot_observed_at":"2026-08-15T15:17:25.028885Z","title":"arXiv preprint arXiv:2402.10885 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.028885Z"},"links":{"cited_paper":"/paper/2402.10885","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:3b6e3a41f2ad19990490e4077c695786a0f2710775e629d4f7b4155c10a0cf17","observation_id":"5c350c00-a53a-4ae9-b99a-ec16adc494b7","resolution":{"observed_at":"2026-08-15T15:17:25.028885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:25.995475Z","title":null,"venue":null,"work_id":"665400e9-3848-42df-ad0f-79bee0234694","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.032713Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:4af7425843303b666d77c6255f37e4050b23e49b8f5ffcfe4560749a0730b955","observation_id":"2497e01e-50a6-4cf1-9a7b-5fc275c12c1c","resolution":{"observed_at":"2026-08-15T15:17:25.999309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:17:25.983517Z","title":null,"venue":null,"work_id":"437e526c-082b-48b6-b2a6-dc1741a0e6fa","year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.036000Z"},"links":{"citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:a98fa9bf9f5a0654b3f7313c314f9e878caa95a74e2c60f79e5bd2d845820d6a","observation_id":"29875e3d-46cd-4eb2-8ab1-f4fd6ebf9814","resolution":{"observed_at":"2026-08-15T15:17:25.987067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-15T15:17:25.038985Z","title":"arXiv preprint arXiv:2403.12945 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.038985Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:a1ea146eba392df6dec790f90353106df218ab2c01b3c4a7249f0ae5b53b567a","observation_id":"3c72600a-bd2e-493f-bfdc-3be46c7cf337","resolution":{"observed_at":"2026-08-15T15:17:25.038985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T15:17:25.042562Z","title":"arXiv preprint arXiv:1711.05101 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T15:17:25.042562Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2608.01066"},"observation_digest":"sha256:d82dd3af60322df76bae51d11a125b7e2fe12da0c6c8968ba45fd619c1292691","observation_id":"07262c0b-5649-48e7-8599-607f4f2c51b0","resolution":{"observed_at":"2026-08-15T15:17:25.042562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01066","last_updated":"2026-08-02T08:06:20Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T17:23:06.415432Z","submitted_at":"2026-08-02T08:06:20Z","title":"OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":49,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2608.01066."}