{"as_of":"2026-08-11T10:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e236a064a13768bca31a47df612a7ee5a79dd7286563e58be98b3522b65bdeb2","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:26:40.671326Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T20:08:36.724196Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:50.503852Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-08-04T09:34:42.018214Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14836","last_updated":"2026-06-09T10:47:44Z","snapshot_observed_at":"2026-08-10T16:19:25.458359Z","submitted_at":"2025-10-16T16:11:18Z","title":"QDepth-VLA: Quantized Depth Prediction as Auxiliary Supervision for Vision-Language-Action Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:34:42.018214Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2510.14836"},"observation_digest":"sha256:cc281a858b75fc0638408dc494e528de0604c4bdf3d28a09df85f55e7075c2a2","observation_id":"0b94335a-12fb-41e2-90b6-d788b28cc417","resolution":{"observed_at":"2026-08-04T09:34:42.018214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2605.05714","last_updated":"2026-05-07T05:57:49Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:57:49Z","title":"TriRelVLA: Triadic Relational Structure for Generalizable Embodied Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T14:54:48.058400Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2605.05714"},"observation_digest":"sha256:5b1c978bd1e94d69829cdaafb91d4dfda7a5f4ba31716b9ffdd9928031e37020","observation_id":"1a73b8ad-194f-4d63-98fa-0d596b87ef88","resolution":{"observed_at":"2026-05-11T18:41:08.210598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.00985","last_updated":"2026-05-31T03:52:53Z","snapshot_observed_at":"2026-08-07T12:06:44.928749Z","submitted_at":"2026-05-31T03:52:53Z","title":"Make Your VLA More Robust Without More Data By Interleaving Motion Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T17:31:55.850609Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.00985"},"observation_digest":"sha256:7f9b2192e909ba9b77a43c353bcefadce57d7479c627d9b67db2b5ce7a246476","observation_id":"2c9a56d3-070a-4b59-88fd-35e378d90c8e","resolution":{"observed_at":"2026-07-01T21:06:13.507847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.05660","last_updated":"2026-06-04T03:43:09Z","snapshot_observed_at":"2026-08-08T10:35:54.242394Z","submitted_at":"2026-06-04T03:43:09Z","title":"Safe Embodied AI for Long-horizon Tasks: A Cross-layer Analysis of Robotic Manipulation","version":1},"reference_index":281,"source":"arxiv_source","source_observed_at":"2026-06-28T01:46:36.081851Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.05660"},"observation_digest":"sha256:1a17083a66b0bb819e16e0c8eb48497ef3c2c3b3553bea4731b134ae4246d418","observation_id":"9e56d40f-df03-490e-9e3e-6a999e6432d0","resolution":{"observed_at":"2026-07-02T12:56:56.778622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.08653","last_updated":"2026-06-07T14:41:22Z","snapshot_observed_at":"2026-08-08T02:07:04.461006Z","submitted_at":"2026-06-07T14:41:22Z","title":"FiberTune: Preserving Action-Fiber Visual Residuals in Vision-Language-Action Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T18:41:51.839543Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.08653"},"observation_digest":"sha256:940bbce480d19c31107b8576d7994ec98dc0b55de9a1cb9e998e569255a1b2eb","observation_id":"326d6b46-addc-493c-bc0a-a133440fcbd4","resolution":{"observed_at":"2026-07-02T22:37:26.704455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.12403","last_updated":"2026-06-10T17:59:08Z","snapshot_observed_at":"2026-08-01T17:35:24.729614Z","submitted_at":"2026-06-10T17:59:08Z","title":"World Pilot: Steering Vision-Language-Action Models with World-Action Priors","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T09:40:02.137152Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.12403"},"observation_digest":"sha256:996dbee84d52d09f28388d8427dfb9ad07dd625bfa8f858446acf2a51b5a5c9e","observation_id":"d867052d-7cf1-447a-8705-3d62bf6ca167","resolution":{"observed_at":"2026-07-03T11:18:03.369410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.12497","last_updated":"2026-06-10T13:26:40Z","snapshot_observed_at":"2026-08-05T05:15:21.338433Z","submitted_at":"2026-06-10T13:26:40Z","title":"$\\mu$VLA: On Recurrent Memory for Partially Observable Manipulation in VLA Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T10:50:55.866910Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.12497"},"observation_digest":"sha256:30bb415ee82ac600f978665cbfb6e4f2ec01efb83ca40b0e82cce68342a76746","observation_id":"64bff53c-ec84-4d38-b22a-9d03d1f93a3d","resolution":{"observed_at":"2026-07-03T08:17:45.609841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.21501","last_updated":"2026-06-19T14:53:40Z","snapshot_observed_at":"2026-08-10T23:41:47.312099Z","submitted_at":"2026-06-19T14:53:40Z","title":"UniviewVLA: A Unified Multiview Vision-Language-Action Model with World Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T14:27:40.585782Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.21501"},"observation_digest":"sha256:ac4aaf88197c279ac106b4896f78c41ec7e3a35f5675472eb4c9349713372e86","observation_id":"5ce132dc-71ee-4a1d-92a7-7f5242e8912e","resolution":{"observed_at":"2026-07-04T06:29:37.526893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2606.27144","last_updated":"2026-06-25T15:17:43Z","snapshot_observed_at":"2026-08-02T04:51:59.516583Z","submitted_at":"2026-06-25T15:17:43Z","title":"PAMAE: Phase-Aware-MoE Action Experts Towards Reliable Flow-Matching Vision-Language-Action Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T05:04:32.182271Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2606.27144"},"observation_digest":"sha256:13078aeb0d050c02254f1453f9056cea95c62209cab162a8733d14a521b4900c","observation_id":"70027506-ebf8-41b6-8701-a825e9bce7d0","resolution":{"observed_at":"2026-07-04T13:39:50.505359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":"2508.19958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-07-04T13:39:50.503852Z","title":"Long-vla: Unleashing long-horizon capability of vision language action model for robot manipulation","venue":null,"work_id":"3b763de6-a4b4-4318-82bb-4c26bfc575c5","year":2025},"citing_paper":{"arxiv_id":"2607.00351","last_updated":"2026-07-01T02:48:17Z","snapshot_observed_at":"2026-08-08T13:08:24.574087Z","submitted_at":"2026-07-01T02:48:17Z","title":"Unleashing More Actions via Action Compositional Training for VLA Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-02T12:04:18.028417Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2607.00351"},"observation_digest":"sha256:3253b49dc0cb0529bf5bd1f0aedcbd20f6f0dc898a2cf23e3a7a129e7073c2cb","observation_id":"d927d3cf-f43c-4730-94f8-54e85c6e4e5f","resolution":{"observed_at":"2026-07-02T12:06:55.279468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19958","snapshot_observed_at":"2026-08-07T20:08:36.724196Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05970","last_updated":"2026-08-06T12:46:13Z","snapshot_observed_at":"2026-08-10T19:09:21.327280Z","submitted_at":"2026-08-06T12:46:13Z","title":"SkillMemo: Expert-guided Skill Memory Framework for Compositional Embodied Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T20:08:36.724196Z"},"links":{"cited_paper":"/paper/2508.19958","citing_paper":"/paper/2608.05970"},"observation_digest":"sha256:4074a01fe169a3e2288d6de47a75c4b6ab626b948198979074d83125c040dc4a","observation_id":"980ced80-b03a-45c9-b69e-f2068dbe297b","resolution":{"observed_at":"2026-08-07T20:08:36.724196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.19958/citation-record","integrity":"/paper/2508.19958/integrity","json":"/paper/2508.19958/citation-record.json","paper":"/paper/2508.19958"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.060575Z","title":null,"venue":null,"work_id":"a4d9fb5b-5d88-4dc5-9025-e309689ffeb6","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.561996Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:86819166e11bf9dc8d838320eba7ab353790653c4eb244f5b651a3c05bf02ffa","observation_id":"e5baeca8-8910-40b4-acd3-ebb463c300a3","resolution":{"observed_at":"2026-08-05T15:26:41.065143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.045279Z","title":"Dalal, T","venue":null,"work_id":"7fcfbab9-7f82-4e92-94a4-9bd9cf3de4ec","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.567126Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:ee7600a83922e2db05461df3614527623d0e03e4ddd3da27bcf45a0e6c0bd944","observation_id":"91818e99-30e6-47dc-ba5c-8f234b81f87d","resolution":{"observed_at":"2026-08-05T15:26:41.050953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.031155Z","title":"Brohan, N","venue":null,"work_id":"148fd593-c01c-4545-8f72-cbe4e6d2f36d","year":2023},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.571883Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:0011ff7c89ea527d06081323bf439bf44f9a45a612aec293e0882658d9923dfb","observation_id":"3644d08c-ae44-4a98-86fa-d61f762d537a","resolution":{"observed_at":"2026-08-05T15:26:41.035607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.017176Z","title":"Zitkovich, T","venue":null,"work_id":"13da19e9-317f-47a4-b082-a407f0abf5e1","year":2023},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.576645Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:44916a08b304ea7bdcf27329bb93a9fd8f257420d820633fb6549ad95e1f4764","observation_id":"9149219a-14e6-47eb-a4ef-6b61aa17c6b9","resolution":{"observed_at":"2026-08-05T15:26:41.021876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:41.002379Z","title":null,"venue":null,"work_id":"f4c64cde-e477-4720-9e07-57c31ae4e79a","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.581938Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:98b079a8e028c188efc60ac3df3712790dbc345760b1564e5a95a35c245aa236","observation_id":"631e2a7f-5ab3-440d-ab29-43a6206e3272","resolution":{"observed_at":"2026-08-05T15:26:41.007045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09268","last_updated":"2025-02-14T01:51:57Z","snapshot_observed_at":"2026-08-10T19:42:29.359480Z","submitted_at":"2025-02-13T12:29:50Z","title":"GEVRM: Goal-Expressive Video Generation Model For Robust Visual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09268","snapshot_observed_at":"2026-08-05T15:26:40.586348Z","title":"Zhang, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.586348Z"},"links":{"cited_paper":"/paper/2502.09268","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:4c3a77af89d7bf7c5d7b619985c03b3d83ba3ab5a1ae1ecfd69f283b03d9dd8b","observation_id":"087655ed-d631-4ecc-90a3-cb09436d4293","resolution":{"observed_at":"2026-08-05T15:26:40.586348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.988355Z","title":null,"venue":null,"work_id":"d0c740e1-caa5-4dfa-b149-b947374e770f","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.592027Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:095e50efe6511c5a7260bd8abac2fc9b424fd282236aee66ea2b29765d1cc8ce","observation_id":"1b352a98-be6f-4cbb-95ff-46de6ddd70c0","resolution":{"observed_at":"2026-08-05T15:26:40.992912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.974472Z","title":null,"venue":null,"work_id":"fbef7a5e-41d0-4fe4-ab42-66a3f8892813","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.595991Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:9cc72b2921c504cbdb27f828b133b1ce88c3e232734d96b84da779f94a7dbf33","observation_id":"0cfb882c-e0fa-4066-a901-e8c1102f8c52","resolution":{"observed_at":"2026-08-05T15:26:40.978960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14795","last_updated":"2025-02-21T08:09:14Z","snapshot_observed_at":"2026-08-08T12:11:17.544790Z","submitted_at":"2025-02-20T18:17:11Z","title":"Humanoid-VLA: Towards Universal Humanoid Control with Visual Integration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14795","snapshot_observed_at":"2026-08-05T15:26:40.600207Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.600207Z"},"links":{"cited_paper":"/paper/2502.14795","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:a01cdeab88da03f2d94b97c294127be800bb93e36cb1e3f2653edce787b9ea81","observation_id":"d0d88848-270b-485f-ab49-ca18a92f2907","resolution":{"observed_at":"2026-08-05T15:26:40.600207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.960441Z","title":null,"venue":null,"work_id":"a2003dc6-8130-4d19-8739-cd8cd14f6b61","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.604602Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:8a3a93b8cae54ad6dd65499dec07479132b95ed72f217df1a650193d10df1117","observation_id":"ba6bac17-d4ce-45f2-b80a-252e9ca690bf","resolution":{"observed_at":"2026-08-05T15:26:40.964874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06782","last_updated":"2025-08-10T06:09:58Z","snapshot_observed_at":"2026-07-06T20:04:06.216583Z","submitted_at":"2024-12-09T18:59:18Z","title":"CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06782","snapshot_observed_at":"2026-08-05T15:26:40.608665Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.608665Z"},"links":{"cited_paper":"/paper/2412.06782","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:bbd64f139de3cf9ed59d7af163302dd33c244166e07c387527fb2e7d09d386c3","observation_id":"cbd469a7-e88f-4f30-be27-ac30c1732ccc","resolution":{"observed_at":"2026-08-05T15:26:40.608665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.945653Z","title":"Konidaris, S","venue":null,"work_id":"c792c880-c352-4285-b4b6-f2b74440f36a","year":2012},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.619107Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:b4c6d9d0cb03c4a8f174d4d0dbf455011001cf208bd1eb875a84ffbc353b9588","observation_id":"5d71e6d9-c2d6-47c0-ac3b-b1f15c22e5a9","resolution":{"observed_at":"2026-08-05T15:26:40.950162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12631","last_updated":"2025-02-21T06:56:09Z","snapshot_observed_at":"2026-08-07T18:09:53.962918Z","submitted_at":"2025-02-18T08:22:20Z","title":"Score-Based Diffusion Policy Compatible with Reinforcement Learning via Optimal Transport","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12631","snapshot_observed_at":"2026-08-05T15:26:40.623243Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.623243Z"},"links":{"cited_paper":"/paper/2502.12631","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:57ab22b0fd0aedef62b20a7e4050ced0bf99957b14839b833a2293697a1b0d7f","observation_id":"55828c2b-7009-468e-9dc1-0683367824ab","resolution":{"observed_at":"2026-08-05T15:26:40.623243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.931063Z","title":"Reuss, Omer Erding Ya&Smurlu, F","venue":null,"work_id":"3500e792-755d-4b40-b50d-cba2ca9bf8cc","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.627613Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:f8f0385bcdab8bb825d47ca783d06e96033a886d7e924d9f4739ce62e203a419","observation_id":"bc1b11ac-c20b-4807-96e2-32c0edf53021","resolution":{"observed_at":"2026-08-05T15:26:40.936294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.916272Z","title":null,"venue":null,"work_id":"5b443e60-13f0-4783-b83d-5d08fdc30094","year":2016},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.632702Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:3f76a227849f8fd42f03587543cadba52482fc4fc5db3bace110249ee8255a21","observation_id":"fa48a7bc-67f7-4436-906f-1d2f9c0a7ad0","resolution":{"observed_at":"2026-08-05T15:26:40.920684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.901058Z","title":"Radford, J","venue":null,"work_id":"3e5f306d-e07d-49f8-b36e-a71f36c31a37","year":2021},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.636789Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:a220deb957aeebce193ce2322e9ba95a991ee6684e594e0e4ce41b869ba89cfe","observation_id":"ede7feda-fc01-4e44-9b30-025433728507","resolution":{"observed_at":"2026-08-05T15:26:40.905683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.883793Z","title":null,"venue":null,"work_id":"72f8fbc5-054d-4d1b-8133-db4c9f94fb1c","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.641019Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:d2e45c95311ae0824361a8eceaccb5f4b99d236b37b02e0bd102678a11317412","observation_id":"ef11b348-566a-412d-a3a9-2aa31de4589c","resolution":{"observed_at":"2026-08-05T15:26:40.890068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.868310Z","title":null,"venue":null,"work_id":"ee4aeaf7-010c-4eab-a4f8-e0b310d15311","year":2022},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.645098Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:3a9fc7b04062a566ebe6a3ff458f992ce5661d2b71ee9f7d2e316711d88e3ce5","observation_id":"e2538010-d873-4d64-b3a4-42db4ec58928","resolution":{"observed_at":"2026-08-05T15:26:40.872704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.853856Z","title":"Perez, F","venue":null,"work_id":"4ebe8d95-905e-4053-bc98-735c9114fbd8","year":2018},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.649252Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:1da43dfa56d5b1788be400ccc3d04285f37d53582377f4f956d809c16aade4a1","observation_id":"cce3582b-0204-4e52-95be-ba6485354f7a","resolution":{"observed_at":"2026-08-05T15:26:40.858333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.838946Z","title":null,"venue":null,"work_id":"1192e121-dd76-4469-bd03-4b622639d524","year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.653430Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:d23e62c6c001cb599dd24850232cd1d527e499a69dcddc6a6df4d4c546296a80","observation_id":"2ac93a40-1187-42b2-af68-4a40cd4976d7","resolution":{"observed_at":"2026-08-05T15:26:40.844020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.824303Z","title":"Zhang, Y","venue":null,"work_id":"9c6b6b0f-e552-4dd0-986a-8150120583ff","year":2025},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.657619Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:1c2be9987d9e45a0fef28ee2e25d5fde846c60854efbaff57c58fd8e507ea1e8","observation_id":"0ddd2c31-4e8c-41ed-a16c-49b954a77db9","resolution":{"observed_at":"2026-08-05T15:26:40.828700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14058","last_updated":"2026-02-13T02:05:15Z","snapshot_observed_at":"2026-08-05T18:48:10.679925Z","submitted_at":"2024-12-18T17:07:20Z","title":"What Matters in Building Vision-Language-Action Models for Generalist Robots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14058","snapshot_observed_at":"2026-08-05T15:26:40.661829Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.661829Z"},"links":{"cited_paper":"/paper/2412.14058","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:e890ad38c8fdc7d61e3572ac02b8fcc80747abb8279a468cef75c851bbf86664","observation_id":"05320bbe-34ca-4a1e-a85c-b9294b827571","resolution":{"observed_at":"2026-08-05T15:26:40.661829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19622","last_updated":"2025-02-01T11:17:14Z","snapshot_observed_at":"2026-08-11T07:19:50.947185Z","submitted_at":"2024-03-28T17:42:54Z","title":"RH20T-P: A Primitive-Level Robotic Dataset Towards Composable Generalization Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19622","snapshot_observed_at":"2026-08-05T15:26:40.666459Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.666459Z"},"links":{"cited_paper":"/paper/2403.19622","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:68797ad795f7d2fc780b6e0959ecdaf98e0b5aff512e5de3d08427a19a5aaef0","observation_id":"2f9875a4-1add-431b-8f49-7694506bc9c4","resolution":{"observed_at":"2026-08-05T15:26:40.666459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:40.808282Z","title":"Put the red block or 1) cal into the drawer","venue":null,"work_id":"06f68cdd-b4ac-46c9-bb9b-724c0645da34","year":2022},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.671326Z"},"links":{"citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:71c2e4104b0ec6d1e4a9cc5d0e448598ca2ced98d7f95ea550b0eb8e57ba25c9","observation_id":"7d539a0b-bd4d-4db2-90ff-76fb24303360","resolution":{"observed_at":"2026-08-05T15:26:40.813926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-05T15:26:40.613924Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation","version":2},"reference_index":367,"source":"pdf_text","source_observed_at":"2026-08-05T15:26:40.613924Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2508.19958"},"observation_digest":"sha256:ef6fc09311c19a51835add36bced889b6ac2b500485bb6fe8dd308ede86708dd","observation_id":"627d1f8e-40e2-4a48-8f1f-776840e74917","resolution":{"observed_at":"2026-08-05T15:26:40.613924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19958","last_updated":"2025-08-28T10:13:01Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T11:55:27.946631Z","submitted_at":"2025-08-27T15:12:03Z","title":"Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 11 inbound Pith citation observations for arXiv:2508.19958."}