{"as_of":"2026-08-13T00:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3f7cc8e31b55f933d72898a852608eb355e87fa2f83a719e735b0aa2cd9766c","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T20:32:30.338797Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:20:25.061646Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T13:53:52.188890Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2601.21998"},"observation_digest":"sha256:206d18b3077fb61f345cb39b6ad4922cd9e59f211a96cabc5c10d10b90de3688","observation_id":"70f6b4a4-e5de-4216-a7ae-e5b9fee4f99e","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-02T22:14:27.081047Z","title":"Mixture of horizons in action chunking.arXiv preprint arXiv:2511.19433, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.17659","last_updated":"2026-07-15T16:20:07Z","snapshot_observed_at":"2026-08-11T12:44:14.562608Z","submitted_at":"2026-02-19T18:59:20Z","title":"When Vision Overrides Language: Evaluating and Mitigating Counterfactual Failures in VLAs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T22:14:27.081047Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2602.17659"},"observation_digest":"sha256:851d14854c22cba8eab6e10b822648fb2c09d73e9b1870518d8ac68a4aff21a4","observation_id":"47bc42b1-ab28-4d87-aae7-363a56d7fc38","resolution":{"observed_at":"2026-08-02T22:14:27.081047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2604.02965","last_updated":"2026-04-03T10:55:51Z","snapshot_observed_at":"2026-08-11T02:34:07.052638Z","submitted_at":"2026-04-03T10:55:51Z","title":"Open-Loop Planning, Closed-Loop Verification: Speculative Verification for VLA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T19:45:17.852646Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2604.02965"},"observation_digest":"sha256:53a6cf6e107333dc6acce7be469336fb5647ab58b99c16154126ae4a39105df5","observation_id":"42786a40-7f6d-4fd3-ba9b-14dbe0f2b5fa","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2604.24086","last_updated":"2026-04-27T06:20:15Z","snapshot_observed_at":"2026-08-03T03:51:20.015005Z","submitted_at":"2026-04-27T06:20:15Z","title":"AsyncShield: A Plug-and-Play Edge Adapter for Asynchronous Cloud-based VLA Navigation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T03:18:03.855477Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2604.24086"},"observation_digest":"sha256:59399151369919bf6edc014979a322b4c47b40adda8fff2583f26afd623bd405","observation_id":"e29367c7-e018-475d-a196-8c0844a8bc41","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.06222","last_updated":"2026-05-09T10:59:29Z","snapshot_observed_at":"2026-07-31T22:35:22.553259Z","submitted_at":"2026-05-07T13:18:28Z","title":"When to Trust Imagination: Adaptive Action Execution for World Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T09:17:18.017938Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.06222"},"observation_digest":"sha256:7dce13d6bf30e967d1f98e7bb2733decf4eff29fa6776bd931e34b2ad49eea75","observation_id":"72c512da-5bf1-4eb3-b1b4-694074150566","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.06222","last_updated":"2026-05-09T10:59:29Z","snapshot_observed_at":"2026-07-31T22:35:22.553259Z","submitted_at":"2026-05-07T13:18:28Z","title":"When to Trust Imagination: Adaptive Action Execution for World Action Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T01:22:49.557507Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.06222"},"observation_digest":"sha256:da224eeca80f480b19218687796dc3dbf100e5cf57bf905fb5884896ae3d9732","observation_id":"74eecce0-2477-404a-bc89-c27e79cae8e4","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.09860","last_updated":"2026-05-20T01:53:04Z","snapshot_observed_at":"2026-08-02T15:20:05.413930Z","submitted_at":"2026-05-11T01:43:13Z","title":"When to Re-Commit: Temporal Abstraction Discovery for Long-Horizon Vision-Language Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T04:58:21.232058Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.09860"},"observation_digest":"sha256:7978dbd3384a1b5713cce5e86ec0fddc9236ee74dad453b30d697652b6cba673","observation_id":"a142c9be-0a8d-402d-836e-96d729e1c3ce","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.09860","last_updated":"2026-05-20T01:53:04Z","snapshot_observed_at":"2026-08-02T15:20:05.413930Z","submitted_at":"2026-05-11T01:43:13Z","title":"When to Re-Commit: Temporal Abstraction Discovery for Long-Horizon Vision-Language Reasoning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T23:23:14.695568Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.09860"},"observation_digest":"sha256:ff1ee3cd7732cce12192155c6fd9e3c724ec5988cb4516b826bff7da25dd85b6","observation_id":"618cfa10-119b-4081-8e73-d163514eee60","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.09860","last_updated":"2026-05-20T01:53:04Z","snapshot_observed_at":"2026-08-02T15:20:05.413930Z","submitted_at":"2026-05-11T01:43:13Z","title":"When to Re-Commit: Temporal Abstraction Discovery for Long-Horizon Vision-Language Reasoning","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T08:33:24.285225Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.09860"},"observation_digest":"sha256:7b02473b002a39994c21606f3e167dd371a08de7d575a8b7494a2ef1e06d11ba","observation_id":"5e8f7c38-10ae-467f-a17a-73a33b19b1b0","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.11567","last_updated":"2026-07-31T00:59:10Z","snapshot_observed_at":"2026-08-05T23:10:41.605658Z","submitted_at":"2026-05-12T05:52:58Z","title":"Dynamic Execution Commitment of Vision-Language-Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T01:45:35.282421Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.11567"},"observation_digest":"sha256:421b913f378ae912bc5a2fec98cbc831af2f62e5769a5c742c62a6979e179d48","observation_id":"d27c06f4-9fbf-4162-a0ce-3cb00f9bbddf","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.11567","last_updated":"2026-07-31T00:59:10Z","snapshot_observed_at":"2026-08-05T23:10:41.605658Z","submitted_at":"2026-05-12T05:52:58Z","title":"Dynamic Execution Commitment of Vision-Language-Action Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T23:09:57.202867Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.11567"},"observation_digest":"sha256:e129e440394ca2b86d9e2e0083281069d072564a3079fdea5dac0fc804b86dca","observation_id":"75ac505f-d2da-47a2-8c7d-3b5ad49f83b5","resolution":{"observed_at":"2026-06-01T03:02:54.298289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2605.11567","last_updated":"2026-07-31T00:59:10Z","snapshot_observed_at":"2026-08-05T23:10:41.605658Z","submitted_at":"2026-05-12T05:52:58Z","title":"Dynamic Execution Commitment of Vision-Language-Action Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T22:46:26.117927Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.11567"},"observation_digest":"sha256:3cf49dbaa4dd0c4b0789a2d71b530c48a67e107517f5863267cfd07972e832db","observation_id":"e6b8c1e6-22c3-41fd-b91d-40043bc5d6a2","resolution":{"observed_at":"2026-07-01T13:45:46.183458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-03T02:22:08.031430Z","title":"Mixture of horizons in action chunking.arXiv preprint arXiv:2511.19433, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.11567","last_updated":"2026-07-31T00:59:10Z","snapshot_observed_at":"2026-08-05T23:10:41.605658Z","submitted_at":"2026-05-12T05:52:58Z","title":"Dynamic Execution Commitment of Vision-Language-Action Models","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T02:22:08.031430Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2605.11567"},"observation_digest":"sha256:a9a299d8e57cdbd4dc394ecf9536fedca93ea296cf96fbd8b4e92de00bdd562c","observation_id":"209fea6c-e3ed-4bda-a7b3-1b0b3ebc8f33","resolution":{"observed_at":"2026-08-03T02:22:08.031430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.00537","last_updated":"2026-07-29T14:34:05Z","snapshot_observed_at":"2026-08-12T21:08:39.637449Z","submitted_at":"2026-05-30T05:11:06Z","title":"PACE: Phase-Aware Chunk Execution for Robot Policies with Action Chunking","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T18:55:23.344228Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.00537"},"observation_digest":"sha256:d642ff69f1916ef9fdced23b7073c978f4de7d82d45eac66dda7a4ab2b714365","observation_id":"7de8a30b-9158-4431-8315-40e299bc698a","resolution":{"observed_at":"2026-06-28T19:02:33.619944Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-02T12:45:03.984131Z","title":"2025.doi:10.48550/arXiv.2511.19433","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00537","last_updated":"2026-07-29T14:34:05Z","snapshot_observed_at":"2026-08-12T21:08:39.637449Z","submitted_at":"2026-05-30T05:11:06Z","title":"PACE: Phase-Aware Chunk Execution for Robot Policies with Action Chunking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T12:45:03.984131Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.00537"},"observation_digest":"sha256:3a237ae90a2a5921eebf5a95b4e5ce51c8b6adba8d61c6802b46ecd1a0f715ae","observation_id":"6f7f187f-d027-44b5-85aa-ff900e14a85f","resolution":{"observed_at":"2026-08-02T12:45:03.984131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.03847","last_updated":"2026-06-02T16:26:32Z","snapshot_observed_at":"2026-07-06T23:44:05.167767Z","submitted_at":"2026-06-02T16:26:32Z","title":"Denoising Tells When to Replan: Denoising-Variance Adaptive Chunking for Flow-Based Robot Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T09:26:28.271486Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.03847"},"observation_digest":"sha256:3c77f8b07cd71cabe8840465d17371f0f34cf1f00ef152e3b69ced3a32c55079","observation_id":"51b5f6f4-cf22-4efa-bdbe-66955353ecea","resolution":{"observed_at":"2026-07-02T04:06:35.292990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.04233","last_updated":"2026-06-02T21:33:28Z","snapshot_observed_at":"2026-08-05T14:25:49.046518Z","submitted_at":"2026-06-02T21:33:28Z","title":"What Are We Actually Benchmarking in Robot Manipulation?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T09:31:39.345777Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.04233"},"observation_digest":"sha256:e406d9f0edce6d309814032ff36ee82efb373adc2f8d99854f7a8b8cabef725b","observation_id":"62fd48a9-3155-4272-a599-36d9661bbec3","resolution":{"observed_at":"2026-07-02T03:56:35.317982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.06491","last_updated":"2026-07-19T18:14:26Z","snapshot_observed_at":"2026-08-02T12:17:07.877886Z","submitted_at":"2026-06-04T17:59:40Z","title":"TempoVLA: Learning Speed-Controllable Vision-Language-Action Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T01:14:14.972805Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.06491"},"observation_digest":"sha256:be4c68aac7be0f86787a0fdf4d3eca3dc028b6b760fb83296402e13da31f9bc7","observation_id":"ec417aa2-467b-4fbb-882d-00d9c51a5815","resolution":{"observed_at":"2026-07-02T13:36:58.784991Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-02T12:17:09.389487Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06491","last_updated":"2026-07-19T18:14:26Z","snapshot_observed_at":"2026-08-02T12:17:07.877886Z","submitted_at":"2026-06-04T17:59:40Z","title":"TempoVLA: Learning Speed-Controllable Vision-Language-Action Policies","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T12:17:09.389487Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.06491"},"observation_digest":"sha256:be57f8fcf9392b880e7703554abf2f4dc65960e73b6ea40e3806e1d38b0e2f46","observation_id":"2209a340-2331-4e7f-95b7-97196d80c9a0","resolution":{"observed_at":"2026-08-02T12:17:09.389487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.11408","last_updated":"2026-07-09T05:54:22Z","snapshot_observed_at":"2026-08-06T22:11:19.177326Z","submitted_at":"2026-06-09T19:58:31Z","title":"Dynamic Execution Horizon Prediction for Chunk-based Robot Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T12:48:32.848242Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.11408"},"observation_digest":"sha256:23ee8f4cbfadae5fb83d8cf55670b6e9810b93bbf768eac20aaefcbdbf4d74e0","observation_id":"13ad0ab2-d5fd-45c0-bcff-9711aff8a08d","resolution":{"observed_at":"2026-07-03T06:17:41.623321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.12475","last_updated":"2026-06-10T05:42:49Z","snapshot_observed_at":"2026-07-06T23:51:22.219590Z","submitted_at":"2026-06-10T05:42:49Z","title":"Learning to Assist: Collaborative VLAs for Implicit Human-Robot Collaboration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T09:57:14.119334Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.12475"},"observation_digest":"sha256:9f53618d6f0ad6b683b350cdec0d95c9e54f8c29752e3b66cf5bcb84f7a3db51","observation_id":"1f423306-2d40-48ad-8ed3-e768ba8a9369","resolution":{"observed_at":"2026-07-03T10:37:56.637819Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.12497","last_updated":"2026-06-10T13:26:40Z","snapshot_observed_at":"2026-08-05T05:15:21.338433Z","submitted_at":"2026-06-10T13:26:40Z","title":"$\\mu$VLA: On Recurrent Memory for Partially Observable Manipulation in VLA Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T10:50:55.866910Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.12497"},"observation_digest":"sha256:54f73e052296becf79d72149343dc091c38fcf1b7e1b1cb2e50219966ec388cb","observation_id":"7d0c40d9-41e3-4b0f-8517-8f8651928be3","resolution":{"observed_at":"2026-07-03T08:17:45.679705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.22540","last_updated":"2026-06-25T01:18:44Z","snapshot_observed_at":"2026-07-06T23:57:23.574340Z","submitted_at":"2026-06-21T14:54:07Z","title":"PolicyTrim: Boosting Intrinsic Policy Efficiency of Vision-Language-Action Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T10:27:00.283283Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.22540"},"observation_digest":"sha256:028fa42d3baf98c76728697ccd1072cbec82828a72ff107afd7fb0ec615b7ebe","observation_id":"3c2b3e55-1fe2-46b4-a986-ca367cba2432","resolution":{"observed_at":"2026-07-04T09:09:43.332561Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2606.26095","last_updated":"2026-06-24T17:59:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-24T17:59:56Z","title":"Learning Action Priors for Cross-embodiment Robot Manipulation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-25T19:09:56.409766Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2606.26095"},"observation_digest":"sha256:4253051423c13dbadd8769600174db5178458a5633bc523cb527cbc4a953efbf","observation_id":"e9896e6b-35d2-4d31-80eb-c60de19b3c0f","resolution":{"observed_at":"2026-07-04T21:00:09.747689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2607.01051","last_updated":"2026-07-05T11:54:19Z","snapshot_observed_at":"2026-07-12T09:02:23.777604Z","submitted_at":"2026-07-01T15:13:12Z","title":"AutoSpeed: Annotation-Free Stage-Adaptive Motion Speed Learning for Robot Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-02T11:10:45.789869Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2607.01051"},"observation_digest":"sha256:802875bcac5a0b20e596e567fd8a68938a5e73b2f3c942027e267db9a8966daa","observation_id":"b52097c7-4d3a-4b1d-b24d-4fe37354469a","resolution":{"observed_at":"2026-07-02T11:16:52.769950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-07-12T09:02:24.063466Z","title":"arXiv preprint arXiv:2511.19433 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.01051","last_updated":"2026-07-05T11:54:19Z","snapshot_observed_at":"2026-07-12T09:02:23.777604Z","submitted_at":"2026-07-01T15:13:12Z","title":"AutoSpeed: Annotation-Free Stage-Adaptive Motion Speed Learning for Robot Manipulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T09:02:24.063466Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2607.01051"},"observation_digest":"sha256:3451155f62c8ea0e2a95370fa852cdefe64464a501d77ec1567e91457b4d66eb","observation_id":"d324f970-54d4-4716-aeb3-4ea045f4bcb7","resolution":{"observed_at":"2026-07-12T09:02:24.063466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2607.01804","last_updated":"2026-07-02T07:18:53Z","snapshot_observed_at":"2026-08-07T01:24:57.162223Z","submitted_at":"2026-07-02T07:18:53Z","title":"VLA-Corrector: Lightweight Detect-and-Correct Inference for Adaptive Action Horizon","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-03T12:20:11.540651Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2607.01804"},"observation_digest":"sha256:d8dcc5add3361ee25521b433469d66b6185e8b971f02e467311f8cc72c26e0c1","observation_id":"e658945d-9eb6-457e-a7cf-5441fcc307ca","resolution":{"observed_at":"2026-07-03T12:28:07.295821Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-07-11T14:18:36.792125Z","title":"Mixture of horizons in action chunking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04739","last_updated":"2026-07-06T07:22:04Z","snapshot_observed_at":"2026-08-02T13:23:13.220023Z","submitted_at":"2026-07-06T07:22:04Z","title":"Spatial Attention: Adapting Execution Horizons for Diffusion Policies via Observation Sensitivity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T14:18:36.792125Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2607.04739"},"observation_digest":"sha256:363bfa294d8cd547d313326b7accd9db119618eb3b605f8cb171a4a0e794286c","observation_id":"5d60841e-b78a-41cc-a5c7-61dbd2de5257","resolution":{"observed_at":"2026-07-11T14:18:36.792125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":"2511.19433","doi":"10.48550/arxiv.2511.19433","metadata_source":"pith","pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture of horizons in action chunking","venue":"cs.RO","work_id":"bf92a5f5-41a7-4430-8d31-7bb2eadf1097","year":2025},"citing_paper":{"arxiv_id":"2607.08751","last_updated":"2026-07-09T17:50:47Z","snapshot_observed_at":"2026-08-03T16:33:12.055484Z","submitted_at":"2026-07-09T17:50:47Z","title":"DexVerse: A Modular Benchmark for Multi-Task, Multi-Embodiment Dexterous Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T02:00:26.267192Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2607.08751"},"observation_digest":"sha256:58184a0a5fe81ea95a3aee154886d95803d52c3d0ec5d997520a8168f0f9bc9e","observation_id":"492057ae-c1f6-4b4d-a1c9-d698561f918c","resolution":{"observed_at":"2026-07-10T02:06:42.081924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-07-30T21:05:52.637963Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26789","last_updated":"2026-07-29T11:31:33Z","snapshot_observed_at":"2026-08-08T10:24:44.011995Z","submitted_at":"2026-07-29T11:31:33Z","title":"CheckVLA: Execution-Time Verification with Action-Conditioned World Model for Long-Horizon Mobile Manipulation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-30T21:05:52.637963Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2607.26789"},"observation_digest":"sha256:24ec905664995cde49814b24cf5cb8a71c3889c0d489ecdce9b772df20f992f7","observation_id":"f385ec68-688c-4fb3-a2c8-2e0588e0400c","resolution":{"observed_at":"2026-07-30T21:05:52.637963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-04T05:05:10.436843Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02547","last_updated":"2026-08-03T17:32:45Z","snapshot_observed_at":"2026-08-09T01:42:37.285387Z","submitted_at":"2026-08-03T17:32:45Z","title":"Why Does Action Chunking Improve Behavioral Cloning Performance in Robotic Control?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T05:05:10.436843Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2608.02547"},"observation_digest":"sha256:bfd8025d371f19d6f9b1d0ea6e608edf731108ce4ac41c0cf109522089e4119f","observation_id":"fcf19fdb-df95-411c-a956-6fe81fcd50fb","resolution":{"observed_at":"2026-08-04T05:05:10.436843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19433","snapshot_observed_at":"2026-08-05T18:20:25.061646Z","title":"arXiv preprint arXiv:2511.19433 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03483","last_updated":"2026-08-04T11:21:08Z","snapshot_observed_at":"2026-08-12T03:29:36.926130Z","submitted_at":"2026-08-04T11:21:08Z","title":"Continue or Replan? Bernoulli-Continuation Policy Learning for Adaptive Horizon Execution","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T18:20:25.061646Z"},"links":{"cited_paper":"/paper/2511.19433","citing_paper":"/paper/2608.03483"},"observation_digest":"sha256:ced005817ff9df9651368f34cbe61a7adf7724331f9c87e700ae790c8dd54eb0","observation_id":"e93ef478-bd15-4be4-9861-96bf0c21e49e","resolution":{"observed_at":"2026-08-05T18:20:25.061646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2511.19433/citation-record","integrity":"/paper/2511.19433/integrity","json":"/paper/2511.19433/citation-record.json","paper":"/paper/2511.19433"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-03T20:32:25.306391Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.306391Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:d76f76b1d8591a57a1ec1c1e812fa4a913cc468abea61e5ddf95a676a516f963","observation_id":"e0dcf9a6-28d2-405d-9267-7cfd94b13c06","resolution":{"observed_at":"2026-08-03T20:32:25.306391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-12T17:29:41.806995Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-03T20:32:25.356424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.356424Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:f8afb1e68cdbb49e1b7ad5d7f94ddf7d69857c1bcc19bf163408aa2a8ca41fdf","observation_id":"f83aef30-84cd-4837-99a3-80ced0b460c6","resolution":{"observed_at":"2026-08-03T20:32:25.356424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-03T20:32:25.453579Z","title":"Paligemma: A versatile 3b vlm for transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.453579Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:7dc4cfca0af57f8a1273f07c50906892476f263dca1eebbb7a4b12802f6cb959","observation_id":"8f910c27-d26b-4a66-bc5c-84ca65ef15f5","resolution":{"observed_at":"2026-08-03T20:32:25.453579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:25.532551Z","title":"Roboagent: Generalization and efficiency in robot manipulation via se- mantic augmentations and action chunking, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.532551Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:6a1c55a1b9f45c5c3aa557f355caebfa807f0e09495a68dd44def904b852c365","observation_id":"d4be69d0-dff7-4b42-8098-0872681cd32c","resolution":{"observed_at":"2026-08-03T20:32:25.532551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-03T20:32:25.624340Z","title":"Gr00t n1: An open foun- dation model for generalist humanoid robots.arXiv preprint arXiv:2503.14734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.624340Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:6cfb1beb5a093825882a2dc44b2f754218d25e1e5457d730d67c6d02c0c3db54","observation_id":"f4c64c22-dc5f-4690-bd3a-de8607a848af","resolution":{"observed_at":"2026-08-03T20:32:25.624340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-03T20:32:25.692132Z","title":"pi 0: A vision-language- action flow model for general robot control.arXiv preprint arXiv:2410.24164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.692132Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:87c7586f65eb2578e0807c7979ddb8c874b906a972dc526ebb72db64d55b12df","observation_id":"7373500c-7519-48a5-aed5-90164726d714","resolution":{"observed_at":"2026-08-03T20:32:25.692132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:25.754673Z","title":"Occam’s razor.Information processing letters, 24(6):377–380, 1987","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.754673Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:4a286d5fb3d735c24ff0157379be877bdefc4554c34c9ec2fe4ecc217331a71e","observation_id":"923b5b7a-e99b-4d4a-9722-b636a35b33fd","resolution":{"observed_at":"2026-08-03T20:32:25.754673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-04T23:08:22.516431Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-03T20:32:25.823841Z","title":"Agibot world colosseo: A large-scale manipula- tion platform for scalable and intelligent embodied systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.823841Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:3ec1c07850295c5d51df4b00a78c392cf7e95a818ff34f030d1c04dd66c87df5","observation_id":"3caa5ebd-2877-451e-b0f9-e24a8101c21a","resolution":{"observed_at":"2026-08-03T20:32:25.823841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-03T20:32:25.898922Z","title":"Univla: Learning to act anywhere with task-centric latent actions.arXiv preprint arXiv:2505.06111, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.898922Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:b62f91213531c4fa31cc6fb0d7f9bf6d2ece1f2979820e595db0d60546a824a6","observation_id":"3a35705d-26ef-4a29-b9a4-cfd79592255c","resolution":{"observed_at":"2026-08-03T20:32:25.898922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-10T07:22:51.573401Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-03T20:32:25.963233Z","title":"Worldvla: Towards autoregressive action world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:25.963233Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:b6ff4bb669f899eaa46e87a3733cc35344ad70439c6eb878e5d1ce0df012ac7d","observation_id":"7d0acd44-973c-436a-8145-eba3851f04b2","resolution":{"observed_at":"2026-08-03T20:32:25.963233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-08-06T13:23:03.968769Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-08-03T20:32:26.053455Z","title":"Gr-3 technical report.arXiv preprint arXiv:2507.15493, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.053455Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:a7c675143fc498965f2b1e1222eff596b973f222721d9159f1ca965c7f38a150","observation_id":"c86dcdde-d573-498e-8df9-94d69147a04a","resolution":{"observed_at":"2026-08-03T20:32:26.053455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:26.117647Z","title":"Robotwin 2.0: A scalable data generator and benchmark with strong domain randomization for robust bimanual robotic manipulation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.117647Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:08d68d8ddf1a8aa7975bd0a631c888ff7abf9b2dee333281f2be8b5145062fee","observation_id":"d5f05ba3-2f92-45ca-b20e-b2dd8eb83dcd","resolution":{"observed_at":"2026-08-03T20:32:26.117647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:26.170721Z","title":"Moto: Latent motion token as the bridging language for robot manipulation.arXiv preprint arXiv:2412.04445, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.170721Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:22dd4add4506fc79bf04c254fb00722b44fd640b65d4a09101c3d250f67de471","observation_id":"eedca211-437c-4ee1-91a0-69840097fe10","resolution":{"observed_at":"2026-08-03T20:32:26.170721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-08T17:26:38.829859Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-03T20:32:26.261658Z","title":"Diffu- sion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.261658Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:fedf2aef6be91bd594a23174ed63994d33397c056661a23b7f85faeabb3efc95","observation_id":"f8822bbc-745e-4a14-a4ef-70d65d671167","resolution":{"observed_at":"2026-08-03T20:32:26.261658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13778","last_updated":"2025-10-15T17:30:05Z","snapshot_observed_at":"2026-07-06T22:32:47.087967Z","submitted_at":"2025-10-15T17:30:05Z","title":"InternVLA-M1: A Spatially Guided Vision-Language-Action Framework for Generalist Robot Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13778","snapshot_observed_at":"2026-08-03T20:32:26.321590Z","title":"Internvla-m1: A spatially guided vision-language-action framework for generalist robot policy.arXiv preprint arXiv:2510.13778, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.321590Z"},"links":{"cited_paper":"/paper/2510.13778","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:90b57648cd8f80bb7eb0fc2b2e032c282eb1607319349b5baa6afddd7cc9ad1c","observation_id":"81093c64-9e59-4af4-a751-c34f678f5b94","resolution":{"observed_at":"2026-08-03T20:32:26.321590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03912","last_updated":"2025-05-06T18:35:07Z","snapshot_observed_at":"2026-08-07T15:49:25.272514Z","submitted_at":"2025-05-06T18:35:07Z","title":"OpenHelix: A Short Survey, Empirical Analysis, and Open-Source Dual-System VLA Model for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03912","snapshot_observed_at":"2026-08-03T20:32:26.436437Z","title":"Openhelix: A short survey, empirical analysis, and open-source dual-system vla model for robotic manipulation.arXiv preprint arXiv:2505.03912, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.436437Z"},"links":{"cited_paper":"/paper/2505.03912","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:186334d798bd980f422dfdf3b8c811e95025b2366c8b4223d5d2e6e8b397d2f9","observation_id":"69574d5e-ea1a-4caa-a6d0-6b36440be8f8","resolution":{"observed_at":"2026-08-03T20:32:26.436437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:26.524477Z","title":"Graspvla: a grasping foundation model pre-trained on billion- scale synthetic action data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.524477Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:279defb4e56c90d23306261a2c3d3a5b2c3ad08cec22cd0aca6ceb463c7b2ea2","observation_id":"0506a26e-cfe9-42ac-afa4-368caf8fa3d4","resolution":{"observed_at":"2026-08-03T20:32:26.524477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:26.611283Z","title":"Interleave-vla: En- hancing robot manipulation with interleaved image-text in- structions.arXiv preprint arXiv:2505.02152, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.611283Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:3a34407ff7d3a4cb8d02516de5536f806e770518b0a2ca1d3cc6ecc24d1452b3","observation_id":"af1ed290-a787-42de-9ade-fa8ee1fb30af","resolution":{"observed_at":"2026-08-03T20:32:26.611283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:26.724510Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.724510Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:9019a74892322657e2c1c861c14e55a9e5d24a37495451738dd01b66351aac4c","observation_id":"d421a931-9a70-410d-ac47-ff031edfeb44","resolution":{"observed_at":"2026-08-03T20:32:26.724510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17561","last_updated":"2025-06-21T03:07:48Z","snapshot_observed_at":"2026-08-12T14:40:18.468179Z","submitted_at":"2025-06-21T03:07:48Z","title":"VLA-OS: Structuring and Dissecting Planning Representations and Paradigms in Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17561","snapshot_observed_at":"2026-08-03T20:32:26.811080Z","title":"Vla-os: Structuring and dissecting planning representations and paradigms in vision-language- action models.arXiv preprint arXiv:2506.17561, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.811080Z"},"links":{"cited_paper":"/paper/2506.17561","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:0d6d82742480d42c888e1c5631dca148b5e963370ab23c61d4496d1c600ce820","observation_id":"c19d9121-4ffe-4a89-83d4-3ddb452ead54","resolution":{"observed_at":"2026-08-03T20:32:26.811080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:26.988241Z","title":"A survey on vision-language- action models for autonomous driving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:26.988241Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:9823825017e1dd8316860e910ff1837c24c11abf239e417b9dde5cc6ac0e60f2","observation_id":"bacc246f-62b3-45c2-9594-64e80dd39a94","resolution":{"observed_at":"2026-08-03T20:32:26.988241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:27.136968Z","title":"Fineclip: Self-distilled region- based clip for better fine-grained understanding.Advances in Neural Information Processing Systems, 37:27896–27918,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:27.136968Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:e718fce09b5fb19d123db5b24f185a9bbab634ed7ebc90533def3b090ac14b8b","observation_id":"66cd26f2-c66c-439e-8b56-2627734ad89b","resolution":{"observed_at":"2026-08-03T20:32:27.136968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-03T20:32:27.255963Z","title":"Openvla: An open-source vision-language-action model.arXiv preprint arXiv:2406.09246, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:27.255963Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:b8058091b4715478fa5280b7b36da5cc505c193f6ab1965a75865a6294bb6311","observation_id":"72d6e80d-0083-4321-a18c-5f147aeb3277","resolution":{"observed_at":"2026-08-03T20:32:27.255963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-03T20:32:27.355162Z","title":"Fine-tuning vision-language-action models: Optimizing speed and suc- cess.arXiv preprint arXiv:2502.19645, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:27.355162Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:4a92bd057fb61877c59a3d0c337979a639edaebb92d83e2c126e7ee19c40b797","observation_id":"a6b8c7d5-26fb-46f2-9268-db864e9ec7fd","resolution":{"observed_at":"2026-08-03T20:32:27.355162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:27.473078Z","title":"Spatial forcing: Implicit spatial representation alignment for vision- language-action model.arXiv preprint arXiv:2510.12276,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:27.473078Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:571355450c0be975778e6821e405b197f465a77fad09de40982b124752a1c6d8","observation_id":"08accf09-5419-47cf-927f-e837d644e628","resolution":{"observed_at":"2026-08-03T20:32:27.473078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-03T20:32:27.625412Z","title":"Cogact: A foundational vision-language-action model for synergizing cognition and action in robotic manip- ulation.arXiv preprint arXiv:2411.19650, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:27.625412Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:28969ae05ecf8bc4456dec333986a29b20b60ed856bf634edbe90b69e188875d","observation_id":"0d09a04f-9252-4e29-b2c9-4f203e45552c","resolution":{"observed_at":"2026-08-03T20:32:27.625412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:27.804252Z","title":"Evo-0: Vision-language- action model with implicit spatial understanding.arXiv preprint arXiv:2507.00416, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:27.804252Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:a33e1e98fcadc96670dc1ed07b8c9d47f097cd7f75e8032bb89e1921e2289182","observation_id":"1780c7b3-7529-49fa-8a34-be9b91ec5722","resolution":{"observed_at":"2026-08-03T20:32:27.804252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-03T20:32:27.979478Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:27.979478Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:aa7955c33af16b85addcdda1a4a10e4d23a86775813f56562570be128a3f3b42","observation_id":"0dba2a39-9d52-4af5-b759-a9b893fbd835","resolution":{"observed_at":"2026-08-03T20:32:27.979478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03310","last_updated":"2023-10-14T15:52:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T23:32:26Z","title":"LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03310","snapshot_observed_at":"2026-08-03T20:32:28.154512Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning.arXiv preprint arXiv:2306.03310, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:28.154512Z"},"links":{"cited_paper":"/paper/2306.03310","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:f2104435248bddecc271ad7226ff879beeb3580bb08fd926d70682efabb5dc25","observation_id":"3b97df11-3ffc-410a-a072-d9525c29d3ab","resolution":{"observed_at":"2026-08-03T20:32:28.154512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:28.295507Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps.Advances in neural information processing systems, 35:5775–5787, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:28.295507Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:7eb11dcdb3c60fb33996bf715bd8f8f5cfcbcb097be06d53c50a92ec9df3502b","observation_id":"34ace99f-ad8a-403c-b237-a5ac39f53367","resolution":{"observed_at":"2026-08-03T20:32:28.295507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:28.408385Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:28.408385Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:3e0e544b95b074aa9a24755aaaf2a47bddf01607409d2d5ed9062301b6d79c1b","observation_id":"d9aa5be5-22ee-404d-901b-a1b654f186a8","resolution":{"observed_at":"2026-08-03T20:32:28.408385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-03T20:32:28.585704Z","title":"Fast: Efficient action tokenization for vision- language-action models.arXiv preprint arXiv:2501.09747,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:28.585704Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:7ba23f7c4764543a633d59caba8fc75e9abf973f1a61860d2d147d93f11389d4","observation_id":"28178c42-aeb1-40bc-8033-01a9d1997d73","resolution":{"observed_at":"2026-08-03T20:32:28.585704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-03T20:32:28.705217Z","title":"Spatialvla: Exploring spatial representations for visual- language-action model.arXiv preprint arXiv:2501.15830,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:28.705217Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:a2415aa62e62288dcc9971698fff5b04841306cafdc46cc64906c967fb237500","observation_id":"2763321e-3fe3-44e3-afda-1f70af923ffa","resolution":{"observed_at":"2026-08-03T20:32:28.705217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:28.825619Z","title":"Sparsely-gated mixture-of-experts pytorch imple- mentation, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:28.825619Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:01ab717592018f5c85390a920916bc6a4a7210153d347dd920b4e1faedb58b5a","observation_id":"850b66c0-1b46-4545-8a7b-9c5535e78543","resolution":{"observed_at":"2026-08-03T20:32:28.825619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19417","last_updated":"2025-07-15T17:44:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T18:58:41Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19417","snapshot_observed_at":"2026-08-03T20:32:28.968924Z","title":"Hi robot: Open-ended instruction following with hierarchical vision-language-action models.arXiv preprint arXiv:2502.19417, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:28.968924Z"},"links":{"cited_paper":"/paper/2502.19417","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:e828aa6153fbd1d238581724b28e85dfc9a98916a3e629062a445b036d5cc3b2","observation_id":"a8f7678e-4112-411e-83ce-3985fcda86e9","resolution":{"observed_at":"2026-08-03T20:32:28.968924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-03T20:32:29.092769Z","title":"Smolvla: A vision-language-action model for afford- able and efficient robotics.arXiv preprint arXiv:2506.01844,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.092769Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:d2f6d63fc27b3ff5baea2a11c7d6e069935e76e6b2d9426731f39f395bd8aecb","observation_id":"8274fb4d-d592-4fc5-8918-0c7741029d93","resolution":{"observed_at":"2026-08-03T20:32:29.092769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12744","last_updated":"2025-05-19T06:00:14Z","snapshot_observed_at":"2026-08-12T10:24:01.104641Z","submitted_at":"2025-05-19T06:00:14Z","title":"Incentivizing Multimodal Reasoning in Large Models for Direct Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12744","snapshot_observed_at":"2026-08-03T20:32:29.151581Z","title":"Incen- tivizing multimodal reasoning in large models for direct robot manipulation.arXiv preprint arXiv:2505.12744, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.151581Z"},"links":{"cited_paper":"/paper/2505.12744","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:189a7fa033d83d1746fa244a9c5c29893fbfdd7084489e02b7ca5f2b8e37961a","observation_id":"97ee8c20-695a-4f66-bf59-d38a765773a6","resolution":{"observed_at":"2026-08-03T20:32:29.151581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-03T20:32:29.209007Z","title":"Octo: An open-source generalist robot policy.arXiv preprint arXiv:2405.12213, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.209007Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:4583b38d560bde071ea11c53eb88b86d360fb8518fbbf59665093d29a914d9d0","observation_id":"d92f0542-4c00-4c58-84ff-2efd77185db9","resolution":{"observed_at":"2026-08-03T20:32:29.209007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:29.278954Z","title":"Vla-adapter: An effective paradigm for tiny-scale vision-language-action model.arXiv preprint arXiv:2509.09372, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.278954Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:bbcab505ea24dc38fe43ec1c00e9331ee555adae106fd399917223798ef1001f","observation_id":"734dbf3a-8ae7-435b-ac2c-5b47827b7554","resolution":{"observed_at":"2026-08-03T20:32:29.278954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19850","last_updated":"2025-06-24T17:59:57Z","snapshot_observed_at":"2026-08-06T22:59:06.087089Z","submitted_at":"2025-06-24T17:59:57Z","title":"Unified Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.19850","snapshot_observed_at":"2026-08-03T20:32:29.361062Z","title":"Unified vision-language-action model.arXiv preprint arXiv:2506.19850, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.361062Z"},"links":{"cited_paper":"/paper/2506.19850","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:ab86ef0b7080d33f04629e300b8068cf88e969c51cef22d42b55fe8480c16aae","observation_id":"83fcaaeb-26c8-4395-90d0-f07501b58f5c","resolution":{"observed_at":"2026-08-03T20:32:29.361062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-03T20:32:29.443468Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.443468Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:0af4611fa1326098738bfbfc7b09d5d13909d74d330a9768c3a6db65fd69434a","observation_id":"e1529c92-b2b4-4caa-9083-32b2e7da06ed","resolution":{"observed_at":"2026-08-03T20:32:29.443468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:29.526936Z","title":"Igniting vlms toward the embodied space.arXiv preprint arXiv:2509.11766, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.526936Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:08f95b20b4a86a66bc39c72dce712c30827d49186878849d4cabbceb5df0a344","observation_id":"b6f34564-4811-49cf-a1df-7e23b9821719","resolution":{"observed_at":"2026-08-03T20:32:29.526936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04447","last_updated":"2025-08-26T08:23:50Z","snapshot_observed_at":"2026-08-05T16:56:52.400110Z","submitted_at":"2025-07-06T16:14:29Z","title":"DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04447","snapshot_observed_at":"2026-08-03T20:32:29.602732Z","title":"Dreamvla: A vision-language-action model dreamed with comprehensive world knowledge.CoRR, abs/2507.04447, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.602732Z"},"links":{"cited_paper":"/paper/2507.04447","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:3a76dabb89ab07587cdf88c1cafa0c7c0d473433ad155b142f8e782434046a85","observation_id":"07c5f748-54cb-4242-9f79-cde0fa0fa7a2","resolution":{"observed_at":"2026-08-03T20:32:29.602732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:29.621993Z","title":"From spatial to actions: Grounding vision-language-action model in spatial foundation priors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.621993Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:15be0aa06aae5d3670531803ebba1d1d90ec8db41bb5690f5f4eb481844fc130","observation_id":"b4e58a7e-7a3b-4905-8044-43921321b03c","resolution":{"observed_at":"2026-08-03T20:32:29.621993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:29.712035Z","title":"Cot-vla: Visual chain-of-thought reason- ing for vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.712035Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:4afe041f4bbe98c9267b02ebe4f19d7f14148f44dbe7a49afb1b18ca16749e05","observation_id":"f4bbcf10-18e9-4cbd-b72f-e00b339da362","resolution":{"observed_at":"2026-08-03T20:32:29.712035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:29.807744Z","title":"Zhao, Vikash Kumar, Sergey Levine, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.807744Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:f6a496aebf95fb7b524baf6a33e4c39729a59a9fbf03e54890bad920dde004b1","observation_id":"236ca3d1-3dc9-4684-99a3-70dc4203430d","resolution":{"observed_at":"2026-08-03T20:32:29.807744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:29.893759Z","title":"Universal actions for enhanced embodied foundation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.893759Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:751a509b71375d798b380feab812709305b60171a38b1af8332fcd7db567575e","observation_id":"ada945c4-4e53-4e5e-ae06-6e9e41196e23","resolution":{"observed_at":"2026-08-03T20:32:29.893759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10274","last_updated":"2025-10-11T16:20:17Z","snapshot_observed_at":"2026-08-11T15:30:01.335662Z","submitted_at":"2025-10-11T16:20:17Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.10274","snapshot_observed_at":"2026-08-03T20:32:29.945264Z","title":"X-vla: Soft-prompted transformer as scalable cross-embodiment vision-language-action model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:29.945264Z"},"links":{"cited_paper":"/paper/2510.10274","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:3f4fab36d8d8f7a45672cf8e644d2a9a7bcd48f96e3ae48fdc78710729cf5827","observation_id":"ed3e7f70-73da-44de-a962-393be8340695","resolution":{"observed_at":"2026-08-03T20:32:29.945264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-12T18:17:40.083518Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-03T20:32:30.041174Z","title":"Tracevla: Visual trace prompting enhances spatial- temporal awareness for generalist robotic policies.arXiv preprint arXiv:2412.10345, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:30.041174Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:a8f66eec3d08f1609b72f87129c7e5bca1578b5cf9e6aba6268850b5c6742dcf","observation_id":"40a23ac0-21c5-4063-9f29-5d5123cac0fd","resolution":{"observed_at":"2026-08-03T20:32:30.041174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:32:30.157531Z","title":"Flowvla: Visual chain of thought-based motion reasoning for vision-language- action models.arXiv preprint arXiv:2508.18269, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:30.157531Z"},"links":{"citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:7ddd3a780f83841c13fe871a0b075f8590e28dd1149cf79b2f1b7103d807bb58","observation_id":"c2b85ea4-3e80-462f-86dd-ba17da70ca28","resolution":{"observed_at":"2026-08-03T20:32:30.157531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-03T20:32:30.269520Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models.arXiv preprint arXiv:2304.10592, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:30.269520Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:af1da66bcd7c8639b8b2f9a726b50dc066792ff3420d9925a30586abae6d685b","observation_id":"8c89c302-f2c6-466c-8d1a-39f81b00270b","resolution":{"observed_at":"2026-08-03T20:32:30.269520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-03T20:32:30.338797Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models.arXiv preprint arXiv:2504.10479, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T20:32:30.338797Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2511.19433"},"observation_digest":"sha256:1e2e3f3a9a72f38b47dcfe31f8907283e7b88369d8b7a3d4fce43554e779b6da","observation_id":"8b6268e2-2457-4ba0-858f-e4f069a439d6","resolution":{"observed_at":"2026-08-03T20:32:30.338797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.19433","last_updated":"2026-05-29T16:37:52Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T17:47:52.404594Z","submitted_at":"2025-11-24T18:59:51Z","title":"Mixture of Horizons in Action Chunking"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 32 inbound Pith citation observations for arXiv:2511.19433."}