{"as_of":"2026-08-06T06:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d31e71b2d3b99eb89c6a677598dff882ef7f63ef304d9d14b082dd1dbd6279de","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:03:21.446755Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2503.03480","last_updated":"2026-04-19T06:23:17Z","snapshot_observed_at":"2026-07-30T14:07:10.544745Z","submitted_at":"2025-03-05T13:16:55Z","title":"SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-23T01:27:33.123243Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2503.03480"},"observation_digest":"sha256:9e2951601f8e2aff8efa75bc13af6c1346d392eb76371edefcba68a084d4f664","observation_id":"eec0d6ab-a241-4887-885e-500239218926","resolution":{"observed_at":"2026-05-23T01:32:22.473964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2507.01925","last_updated":"2025-07-02T17:34:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T17:34:52Z","title":"A Survey on Vision-Language-Action Models: An Action Tokenization Perspective","version":1},"reference_index":276,"source":"pdf_text","source_observed_at":"2026-05-17T14:08:34.893876Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2507.01925"},"observation_digest":"sha256:47964bd75606dff7e1d7a7095d8183e8ba127e9059e304e492550a28f9e1ada7","observation_id":"1deb9fcd-83d5-4411-a38a-1555e06bbfb3","resolution":{"observed_at":"2026-05-17T14:08:35.362092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-14T22:23:14.621091Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2507.21046"},"observation_digest":"sha256:4cf1dfa93c58caeb9789de0abb35a722c0d0466adbbd6f24f8d405c47ba3f8e0","observation_id":"f6521287-567f-486e-a43c-569efabdd807","resolution":{"observed_at":"2026-05-14T22:23:15.824554Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-05T17:03:21.446755Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long- horizon reasoning tasks.arXiv preprint arXiv:2412.18194,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17230","last_updated":"2025-09-06T14:24:21Z","snapshot_observed_at":"2026-08-05T17:03:20.491893Z","submitted_at":"2025-08-24T07:06:56Z","title":"4D Visual Pre-training for Robot Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T17:03:21.446755Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2508.17230"},"observation_digest":"sha256:08a86cb706040f174c5d017598f9f76354bfc1567c5ffaa5301167e5370a1d80","observation_id":"2d85b8e6-4ffb-4fe8-823f-1a8e01e82eb8","resolution":{"observed_at":"2026-08-05T17:03:21.446755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-05T13:31:09.974877Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-08-05T13:31:08.573875Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:31:09.974877Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2509.00576"},"observation_digest":"sha256:a602861c8e921f5681e9f4f9fcd1532476f8180abdd1ab20dcb52331f9c65331","observation_id":"dc7d9943-095a-469d-b367-3aaa6d1ef8b4","resolution":{"observed_at":"2026-08-05T13:31:09.974877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-03T22:29:59.056501Z","title":"opening and closing show- case","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2511.10276","last_updated":"2026-05-30T15:10:06Z","snapshot_observed_at":"2026-08-03T22:29:55.549767Z","submitted_at":"2025-11-13T13:03:36Z","title":"RoboBenchMart: Benchmarking Robots in Retail Environment","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T22:29:59.056501Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2511.10276"},"observation_digest":"sha256:66ec08e7914a649e9d992fc514a728264e0adc086e65ca4a4b0e54d3bd017b6f","observation_id":"e85c76da-2b42-4b5d-be22-58099d2e4007","resolution":{"observed_at":"2026-08-03T22:29:59.056501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-03T13:53:27.342980Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long- horizon reasoning tasks.arXiv preprint arXiv:2412.18194,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.22539","last_updated":"2026-07-02T08:55:28Z","snapshot_observed_at":"2026-08-06T03:03:38.906157Z","submitted_at":"2025-12-27T09:40:54Z","title":"VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action Models","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T13:53:27.342980Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2512.22539"},"observation_digest":"sha256:539b8bc249902c6efedd7a4551d63fff832980efaa44b0805e2f3fa75b4ff54c","observation_id":"961ea27c-946d-4443-9f19-e2a797e9bb96","resolution":{"observed_at":"2026-08-03T13:53:27.342980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-02T23:49:03.695895Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.12628","last_updated":"2026-06-04T11:43:40Z","snapshot_observed_at":"2026-08-02T23:48:53.948791Z","submitted_at":"2026-02-13T05:15:50Z","title":"Beyond Imitation: Reinforcement Learning-Based Sim-Real Co-Training for VLA Models","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:03.695895Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2602.12628"},"observation_digest":"sha256:a315f0a74a6ef0e9c96bf0c91d560c62f46f5e11fc3e5d2ee318daaa814409a9","observation_id":"4cd4cb20-7d0a-4d33-833a-a0527cd597af","resolution":{"observed_at":"2026-08-02T23:49:03.695895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2603.13966","last_updated":"2026-04-17T09:44:22Z","snapshot_observed_at":"2026-07-06T22:49:01.769027Z","submitted_at":"2026-03-14T14:38:53Z","title":"vla-eval: A Unified Evaluation Harness for Vision-Language-Action Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T11:24:45.578472Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2603.13966"},"observation_digest":"sha256:a5f6f7ffd8e0cb8951e679244494dda0b26e785e6248c6edc2f70ce2c69982a6","observation_id":"f09b8d10-664f-4342-8997-3abb78eb47be","resolution":{"observed_at":"2026-05-15T11:25:30.899585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2605.06311","last_updated":"2026-05-07T14:13:05Z","snapshot_observed_at":"2026-07-06T23:18:46.145104Z","submitted_at":"2026-05-07T14:13:05Z","title":"Toward Visually Realistic Simulation: A Benchmark for Evaluating Robot Manipulation in Simulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T09:09:13.191350Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2605.06311"},"observation_digest":"sha256:0686ed60ed21fc0fc0b638330fd907c51a57b75c1a82d2d8a47f329976145902","observation_id":"c7685e57-c745-4ce7-bce3-845f5c60ca7b","resolution":{"observed_at":"2026-05-11T20:26:10.905387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2605.10408","last_updated":"2026-05-16T05:46:37Z","snapshot_observed_at":"2026-08-02T20:39:01.404914Z","submitted_at":"2026-05-11T11:46:57Z","title":"VISOR: A Vision-Language Model-based Test Oracle for Testing Robots","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-12T05:17:03.803350Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2605.10408"},"observation_digest":"sha256:985fe945e9236babc771692ae0a3fec90f1a580afa09f38f7415679b0223c477","observation_id":"97a3e32d-23e3-47a3-9110-8386a18aba9e","resolution":{"observed_at":"2026-05-12T05:21:23.375027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2605.10408","last_updated":"2026-05-16T05:46:37Z","snapshot_observed_at":"2026-08-02T20:39:01.404914Z","submitted_at":"2026-05-11T11:46:57Z","title":"VISOR: A Vision-Language Model-based Test Oracle for Testing Robots","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:25.871817Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2605.10408"},"observation_digest":"sha256:28787b192063bbf53eccdd51e28b3bf81c38a0168aacbcdf79ec0f1a364e9d46","observation_id":"c39407f3-b62f-4472-ad39-ef5a1164ba67","resolution":{"observed_at":"2026-05-20T22:29:08.992580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":240,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:2693f36fc188a46435aa6c16394e511f7b024a6b54917d4d1f64038827d484de","observation_id":"9816f0e6-a24b-4a4b-a4df-317a72ce36f7","resolution":{"observed_at":"2026-05-13T05:07:18.033580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2605.18727","last_updated":"2026-05-18T17:51:34Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:51:34Z","title":"DexHoldem: Playing Texas Hold'em with Dexterous Embodied System","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T09:38:43.801252Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2605.18727"},"observation_digest":"sha256:98dde22bb26aa886bdc70aa014bcd64895c4ced834d29c402f3b28b6067320ca","observation_id":"88885839-87d0-4bda-81c5-fa7e8efecb9c","resolution":{"observed_at":"2026-05-20T09:43:11.069321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2605.27759","last_updated":"2026-05-26T23:17:39Z","snapshot_observed_at":"2026-07-06T23:37:27.309837Z","submitted_at":"2026-05-26T23:17:39Z","title":"Colosseum V2: Benchmarking Generalization for Vision Language Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T16:32:32.885345Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2605.27759"},"observation_digest":"sha256:d39c0158aa9c091e13a2afcf490c7891bd04db4e18137ad4bddc96158d354733","observation_id":"ed0293e3-433d-4eaf-91e9-64e563944e18","resolution":{"observed_at":"2026-06-29T16:33:38.665724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.02277","last_updated":"2026-06-01T14:02:37Z","snapshot_observed_at":"2026-07-06T23:42:44.661608Z","submitted_at":"2026-06-01T14:02:37Z","title":"RoboSemanticBench: Diagnosing Semantic Grounding in Action Prediction for VLA Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T14:39:27.174418Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.02277"},"observation_digest":"sha256:517e18eaee29b52f05852d1630945c42f00bbaf98ebff016e6fd33a1cec289ba","observation_id":"92f94aae-21c1-4a8e-b7aa-8531b06582f0","resolution":{"observed_at":"2026-07-01T23:06:20.691103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.03784","last_updated":"2026-06-03T08:29:49Z","snapshot_observed_at":"2026-08-02T17:48:25.989693Z","submitted_at":"2026-06-02T15:37:59Z","title":"Revisiting Embodied Chain-of-Thought for Generalizable Robot Manipulation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T09:40:04.685274Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.03784"},"observation_digest":"sha256:63816f80bcf411a4a7c500c1ebee0e9ce40466f2564072fd54cf280e45a862a2","observation_id":"713e4e26-5890-49bd-aad6-ce5ce4ff1326","resolution":{"observed_at":"2026-07-02T03:46:33.226420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.07723","last_updated":"2026-06-05T16:21:27Z","snapshot_observed_at":"2026-08-02T03:37:35.733251Z","submitted_at":"2026-06-05T16:21:27Z","title":"VoLo: A Physical Orchestrator for Open-Vocabulary Long-Horizon Manipulation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-27T21:40:00.330510Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.07723"},"observation_digest":"sha256:07c286994bc2349473ace89a0972656b6dc3908042d2e151e776fb4341f9bcf2","observation_id":"dab1c090-3dd6-499e-bb53-5f2e630a387a","resolution":{"observed_at":"2026-07-02T19:07:18.169340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.09669","last_updated":"2026-06-08T15:51:51Z","snapshot_observed_at":"2026-08-02T20:17:41.727375Z","submitted_at":"2026-06-08T15:51:51Z","title":"SpatialWorld: Benchmarking Interactive Spatial Reasoning of Multimodal Agents in Real-World Tasks","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-27T16:35:14.099586Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.09669"},"observation_digest":"sha256:7b61e959c155040340659a96845010c5364f12ee5723036ba1ed7046e367a576","observation_id":"26ed2b1d-1f73-49cf-9e10-c90681737d50","resolution":{"observed_at":"2026-07-03T01:27:30.622739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.10366","last_updated":"2026-06-09T03:25:02Z","snapshot_observed_at":"2026-08-05T23:08:04.206475Z","submitted_at":"2026-06-09T03:25:02Z","title":"A Practical Recipe Towards Improving Sim-and-Real Correlation for VLA Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T13:06:35.282837Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.10366"},"observation_digest":"sha256:78030eaa6f7b3ce1a346333d5cf6fe700b0fd1ac62f14619cb69dc0b7b86eb5b","observation_id":"da963171-54b4-4abf-8d30-2b04a5f3235c","resolution":{"observed_at":"2026-07-03T05:47:41.125593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.10382","last_updated":"2026-06-09T03:47:54Z","snapshot_observed_at":"2026-08-02T11:10:26.053834Z","submitted_at":"2026-06-09T03:47:54Z","title":"UMI-Bench 1.0: An Open and Reproducible Real-World Benchmark for Tabletop Robotic Manipulation with UMI Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T12:59:26.898710Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.10382"},"observation_digest":"sha256:bcbddfe55065d297ea8efa63e9f01586848e02798deff8d45ec9f649da3a9b3a","observation_id":"d2911b14-c2e2-4ee9-85ee-99d4b08fa3d1","resolution":{"observed_at":"2026-07-03T05:57:41.785689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.19297","last_updated":"2026-06-17T17:20:46Z","snapshot_observed_at":"2026-07-06T23:54:37.596257Z","submitted_at":"2026-06-17T17:20:46Z","title":"Does VLA Even Know the Basics? Measuring Commonsense and World Knowledge Retention in Vision-Language-Action Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-26T20:55:29.230477Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.19297"},"observation_digest":"sha256:7512c74ecb3eb77091c37d8af8920fa3026d4e6dd5ac1ce7466709017b6e61d6","observation_id":"a59bb101-0cca-4d05-b79d-351c3ec5b00f","resolution":{"observed_at":"2026-07-04T00:49:19.015844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2606.20781","last_updated":"2026-06-18T17:05:19Z","snapshot_observed_at":"2026-08-03T05:46:19.564000Z","submitted_at":"2026-06-18T17:05:19Z","title":"World Action Models: A Survey","version":1},"reference_index":197,"source":"pdf_text","source_observed_at":"2026-06-26T17:11:12.686936Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2606.20781"},"observation_digest":"sha256:93bb0deec7e677a92b6964d673288fb159ebbe2549b7cd6bf65fb08878d3054b","observation_id":"e772ff54-ed4f-4dbd-83ce-6f4a1296f6cb","resolution":{"observed_at":"2026-07-04T04:09:35.430139Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2607.02195","last_updated":"2026-07-02T14:03:44Z","snapshot_observed_at":"2026-08-04T02:33:13.605142Z","submitted_at":"2026-07-02T14:03:44Z","title":"Bridge-WA: Predicting Where and How the World Changes for Robotic Action","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-03T11:28:50.286894Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2607.02195"},"observation_digest":"sha256:f12a68d90a091f4e94d182e43a5dc89751d2988a6bdb17fa09008e8ad845f986","observation_id":"95799076-95f7-4d13-8d90-ac53db763ee6","resolution":{"observed_at":"2026-07-03T11:38:04.579410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2412.18194","doi":"10.48550/arxiv.2412.18194","metadata_source":"pith","pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vlabench: A large-scale benchmark for language-conditioned robotics manipulation with long-horizon reasoning tasks","venue":"cs.RO","work_id":"9ce9e004-2bc2-433e-82c4-460eddd18830","year":2024},"citing_paper":{"arxiv_id":"2607.06370","last_updated":"2026-08-03T07:05:26Z","snapshot_observed_at":"2026-08-06T05:35:22.239069Z","submitted_at":"2026-07-07T15:10:15Z","title":"ActionCache: Training-Free Acceleration for Vision-Language-Action Models with Action Caching and Refinement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-08T08:19:27.960645Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2607.06370"},"observation_digest":"sha256:5d4cfec43462947227a21f84a6a80683602be752e5d0e45dcd13f6a481b6a4b7","observation_id":"f9ddcd77-ad4c-4ab3-b7de-2247332469e1","resolution":{"observed_at":"2026-07-08T08:24:47.094418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-04T04:31:42.200463Z","title":"2412.18194 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.06370","last_updated":"2026-08-03T07:05:26Z","snapshot_observed_at":"2026-08-06T05:35:22.239069Z","submitted_at":"2026-07-07T15:10:15Z","title":"ActionCache: Training-Free Acceleration for Vision-Language-Action Models with Action Caching and Refinement","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T04:31:42.200463Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2607.06370"},"observation_digest":"sha256:78b7b56a3bfc35be8fff8f31af7a570fdb3ebaed11354822bd15c755371263f0","observation_id":"43b3b4f2-9de9-4796-8040-d5b0b3f21b88","resolution":{"observed_at":"2026-08-04T04:31:42.200463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-02T02:25:54.279975Z","title":"Vlabench: A large-scale benchmark for language- conditioned robotics manipulation with long-horizon reasoning tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.279975Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:5c5bdf3637e8fb6be67d2423932efd8589273dfb1005acb3eb914e6c9681a4f9","observation_id":"481223e8-41e8-4ee7-9ff0-c15a83959a0f","resolution":{"observed_at":"2026-08-02T02:25:54.279975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-07-30T12:42:18.656193Z","title":"VLABench: A large-scale benchmark for language- conditioned robotics manipulation with long-horizon reasoning tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23783","last_updated":"2026-07-26T17:58:53Z","snapshot_observed_at":"2026-08-04T19:01:56.946311Z","submitted_at":"2026-07-26T17:58:53Z","title":"$N_0$-TWAM: Scaling Tactile-Native World-Action Model for Contact-Rich Manipulation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-30T12:42:18.656193Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2607.23783"},"observation_digest":"sha256:64877342b375d1e4266de25dd4369474fbca65c0c70c708659e1538bfa74763d","observation_id":"eb710edc-4f47-4d25-8e93-ae7a0192a90c","resolution":{"observed_at":"2026-07-30T12:42:18.656193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18194/citation-record","integrity":"/paper/2412.18194/integrity","json":"/paper/2412.18194/citation-record.json","paper":"/paper/2412.18194"},"outbound":[],"paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2412.18194."}