{"as_of":"2026-08-06T19:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:472a046919247301aea0f0df0cab2640e3ebf884a8284ebf2906a834893783dc","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":46,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:40:57.295726Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T10:59:46.979599Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-04T22:55:29.938569Z","title":"Discrete diffusion vla: Bringing dis- crete diffusion to action decoding in vision-language-action policies.arXiv preprint arXiv:2508.20072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06932","last_updated":"2025-09-10T14:34:25Z","snapshot_observed_at":"2026-08-04T22:55:29.306356Z","submitted_at":"2025-09-08T17:45:40Z","title":"LLaDA-VLA: Vision Language Diffusion Action Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T22:55:29.938569Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2509.06932"},"observation_digest":"sha256:280db812ea2fb5374e54b3d04860a9e253750e3ab3d077b763e06e2c17294ec1","observation_id":"6e0c8d87-bb01-4e80-bf68-19b7a6e696be","resolution":{"observed_at":"2026-08-04T22:55:29.938569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2511.14148","last_updated":"2026-05-07T13:40:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-18T05:21:11Z","title":"AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-17T21:28:18.630934Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2511.14148"},"observation_digest":"sha256:4507668e0e7ed91703628dac9a371dbc458122054cc9e29a5c4ef8a10cf9786a","observation_id":"990a1926-b791-4b74-9c4c-06eba12504a9","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-03T13:29:52.397026Z","title":"Discrete diffusion vla: Bringing discrete diffusion to action decoding in vision-language-action policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.24125","last_updated":"2026-07-26T09:02:49Z","snapshot_observed_at":"2026-08-06T15:18:44.154246Z","submitted_at":"2025-12-30T10:18:42Z","title":"Unified Embodied VLM Reasoning with Robotic Action via Autoregressive Discretized Pre-training","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T13:29:52.397026Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2512.24125"},"observation_digest":"sha256:bcbe5d5b23c04d445a7491a15f41f3bb44bd3673e06f2bd747bf81446e752b8b","observation_id":"0c418813-5f69-4a9d-91eb-3ebcbc5f69ab","resolution":{"observed_at":"2026-08-03T13:29:52.397026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T13:53:52.188890Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2601.21998"},"observation_digest":"sha256:6b4eb474065769609ab9a134d634388d2b111a75a233b86edc279da3329aef3a","observation_id":"1f3c8176-75ba-486d-87c3-7842a682ba6e","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2602.11236","last_updated":"2026-04-14T10:01:08Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:47:01Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T03:11:52.645633Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2602.11236"},"observation_digest":"sha256:67b6a87b80c6f77ac19aa85f4bdee2bcc0d7f0b8cdc0c88e386e6868df56ea45","observation_id":"81987015-53bd-429f-b8c0-e636966b6203","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2602.12978","last_updated":"2026-05-17T13:09:20Z","snapshot_observed_at":"2026-08-05T03:16:35.662407Z","submitted_at":"2026-02-13T14:56:06Z","title":"Learning Native Continuation for Action Chunking Flow Policies","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T12:38:26.522838Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2602.12978"},"observation_digest":"sha256:e43e184cdb99c421ff19a7370cdf7af43a1fe1591e29cc42f0c9a8dbfb82d6e7","observation_id":"0bf042ec-7f67-47d9-b2e0-694c881d8329","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2602.19710","last_updated":"2026-07-07T15:49:26Z","snapshot_observed_at":"2026-08-02T21:37:08.464741Z","submitted_at":"2026-02-23T11:00:08Z","title":"PoseVLA: Universal Pose Pretraining for Generalizable Vision-Language-Action Policies","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T13:04:30.544504Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2602.19710"},"observation_digest":"sha256:888ce27b8be3b2ae9f48b3b489f6e77054cde9e335ccea21d45f4ec9a034ce5f","observation_id":"d38994ca-88c6-473d-8cc8-d55ae1141448","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-02T21:37:12.445617Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies.arXiv preprint arXiv:2508.20072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.19710","last_updated":"2026-07-07T15:49:26Z","snapshot_observed_at":"2026-08-02T21:37:08.464741Z","submitted_at":"2026-02-23T11:00:08Z","title":"PoseVLA: Universal Pose Pretraining for Generalizable Vision-Language-Action Policies","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T21:37:12.445617Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2602.19710"},"observation_digest":"sha256:998806281e1b51a3e6f986e4d4b26204bd81569d53452ee5f65faea5ae39be56","observation_id":"ff1c7ab5-0453-4562-ab5d-224f51eef893","resolution":{"observed_at":"2026-08-02T21:37:12.445617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-02T18:49:51.236618Z","title":"Discrete diffusion vla: Bringing discrete diffusion to action decoding in vision-language- action policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-02T18:49:49.564552Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.236618Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:cd22de42a29e55ecf164dd39340f4aa0363b8f9e716e2054bc810c05f898fff3","observation_id":"c3c9fbe9-4f41-448f-9aca-588c7b772959","resolution":{"observed_at":"2026-08-02T18:49:51.236618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2604.14732","last_updated":"2026-04-19T07:53:54Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T07:46:05Z","title":"World-Value-Action Model: Implicit Planning for Vision-Language-Action Systems","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T11:25:57.218073Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2604.14732"},"observation_digest":"sha256:0e7508278785af351809b3a30975eb6e0b2585f82952bd07016b65041516f572","observation_id":"0bdb9a1a-0e9f-40a0-8cc3-6a935ba60db6","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2604.20472","last_updated":"2026-04-22T11:58:05Z","snapshot_observed_at":"2026-07-06T23:06:55.880484Z","submitted_at":"2026-04-22T11:58:05Z","title":"Temporal Difference Calibration in Sequential Tasks: Application to Vision-Language-Action Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-09T23:59:32.295839Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2604.20472"},"observation_digest":"sha256:5fddbecc3e95980dcdc068a1e1ff5fd592293c29d1c3bfa9cf2b208f00c37efe","observation_id":"c12da3f3-3f07-4d5a-9f22-585b703f5710","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2604.22152","last_updated":"2026-04-24T01:50:53Z","snapshot_observed_at":"2026-07-06T23:08:37.811548Z","submitted_at":"2026-04-24T01:50:53Z","title":"dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T11:45:18.081248Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2604.22152"},"observation_digest":"sha256:63d410cfd5ecc3f50fcda68b6b502b1c08b991168a9391a2784b7229cd853ab8","observation_id":"469d268e-5ef4-4359-94bb-6f075d028742","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2604.25050","last_updated":"2026-06-03T06:10:32Z","snapshot_observed_at":"2026-07-06T23:10:57.164248Z","submitted_at":"2026-04-27T23:04:03Z","title":"DiscreteRTC: Discrete Diffusion Policies are Natural Asynchronous Executors","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T02:30:30.319810Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2604.25050"},"observation_digest":"sha256:401266c6c2fd6049736a4155655bfed3b706e33ce4913939cef19ce19b41a596","observation_id":"7b75fe9c-ea7b-4b75-8e30-b81d4b825ac6","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2604.25050","last_updated":"2026-06-03T06:10:32Z","snapshot_observed_at":"2026-07-06T23:10:57.164248Z","submitted_at":"2026-04-27T23:04:03Z","title":"DiscreteRTC: Discrete Diffusion Policies are Natural Asynchronous Executors","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-01T08:32:26.160039Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2604.25050"},"observation_digest":"sha256:f1330f0197fab46dc3cb5a60dcf935b18169edae967f41560066149ee59a4c2b","observation_id":"41046c62-a3f3-4b98-8318-d6244e331308","resolution":{"observed_at":"2026-07-01T08:35:33.433471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T20:48:01.461993Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.00078"},"observation_digest":"sha256:d02eeaeeb667bbbf5a3d86dad5a4f101ae1b5e0e7e2b0406c7b9ef7a3f1f18dd","observation_id":"796bad1b-c56a-446e-b08a-921c48372e0c","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.09302","last_updated":"2026-05-10T03:59:40Z","snapshot_observed_at":"2026-08-02T09:00:26.118638Z","submitted_at":"2026-05-10T03:59:40Z","title":"Discrete Langevin-Inspired Posterior Sampling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T03:21:21.408659Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.09302"},"observation_digest":"sha256:3930bb629f95176ecad146a9d1d0c4d8d420396d7c18826dd75fea7a10b08d67","observation_id":"ff76b89a-b6b3-4c48-a2e7-838c77968dda","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.10925","last_updated":"2026-05-11T17:56:02Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:56:02Z","title":"PriorVLA: Prior-Preserving Adaptation for Vision-Language-Action Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T03:37:53.732205Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.10925"},"observation_digest":"sha256:9d27bbca7d67e811d3c572a3d87692704f8241578b945c6058187bc23986a532","observation_id":"fabc04d5-a00d-4a69-9e02-1ea7a07ddb79","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.11459","last_updated":"2026-05-14T03:19:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T03:17:59Z","title":"Overcoming Dynamics-Blindness: Training-Free Pace-and-Path Correction for VLA Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T02:19:39.604140Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.11459"},"observation_digest":"sha256:9bbf8f2600b0821a1e094aa78ec4ade33024f08ab66eb2d06324ce57855e7353","observation_id":"94ea68e4-b8f8-433e-af0b-a91220a8f3ff","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.11459","last_updated":"2026-05-14T03:19:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T03:17:59Z","title":"Overcoming Dynamics-Blindness: Training-Free Pace-and-Path Correction for VLA Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T06:13:12.442859Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.11459"},"observation_digest":"sha256:1f9d498014c32d96fbb31385ac77fb0e287dd0ee24ceaa0cb7e18581781e8e8c","observation_id":"a93d7a3c-a46a-4e3d-aec4-68dca469a277","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.11832","last_updated":"2026-05-12T09:21:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T09:21:29Z","title":"Learning Action Manifold with Multi-view Latent Priors for Robotic Manipulation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-13T05:25:18.120832Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.11832"},"observation_digest":"sha256:ca4c7e7e4463a7fae0184518edbd893cf0f9120f84bfaaa13671c9da043bda18","observation_id":"51c0309e-8e16-4b81-be9f-6f25b96e42c1","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.12369","last_updated":"2026-06-01T11:34:15Z","snapshot_observed_at":"2026-08-02T11:53:05.192943Z","submitted_at":"2026-05-12T16:38:40Z","title":"GuidedVLA: Specifying Task-Relevant Factors via Plug-and-Play Action Attention Specialization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T03:57:10.338617Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.12369"},"observation_digest":"sha256:c26d373bdf7dd01f11283de39764a2fe2613c98e4f876c3151994ccc5d84eb58","observation_id":"bfc615dd-f361-43f4-bc9f-a7fba6842ce4","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.12369","last_updated":"2026-06-01T11:34:15Z","snapshot_observed_at":"2026-08-02T11:53:05.192943Z","submitted_at":"2026-05-12T16:38:40Z","title":"GuidedVLA: Specifying Task-Relevant Factors via Plug-and-Play Action Attention Specialization","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-30T22:11:21.596611Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.12369"},"observation_digest":"sha256:df7ff2b39d3939eab36f189d7b9eafc971280e4151e6954b8c02a6423e62888d","observation_id":"ed43a84d-712b-4023-b276-d850142d72b1","resolution":{"observed_at":"2026-07-01T14:15:46.642975Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.13382","last_updated":"2026-05-13T11:37:51Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T11:37:51Z","title":"BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T17:51:48.905620Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.13382"},"observation_digest":"sha256:2482fc093fafbaa758295915bd59c6cd3a9dffa73cb4a770bbd48f4ce9dfbf28","observation_id":"210df7a4-a378-4058-82a9-add219ca30a0","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.19282","last_updated":"2026-05-19T03:00:26Z","snapshot_observed_at":"2026-07-06T23:30:02.207108Z","submitted_at":"2026-05-19T03:00:26Z","title":"Rethinking Muon Beyond Pretraining: Spectral Failures and High-Pass Remedies for VLA and RLVR","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T07:14:31.613251Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.19282"},"observation_digest":"sha256:2547a67bc19fd3348260413f4449536bf5d1d38d100c3dc0fc1a477c2857094e","observation_id":"3aa68753-ea48-42f0-bbd8-51b722a00694","resolution":{"observed_at":"2026-06-02T03:04:00.649074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.24890","last_updated":"2026-06-08T07:28:33Z","snapshot_observed_at":"2026-08-04T02:11:27.874111Z","submitted_at":"2026-05-24T06:28:53Z","title":"QuoVLA: Quotient Space for Vision-Language-Action Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T12:09:12.124995Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.24890"},"observation_digest":"sha256:6d87aea0dcc78910e08277c76c86d3c56659fa506a16442281dacc4b9c2cbcb1","observation_id":"5d08765c-8c5a-4cd5-baf5-8885fc9895c9","resolution":{"observed_at":"2026-06-30T12:34:39.480766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2605.25044","last_updated":"2026-05-24T12:41:34Z","snapshot_observed_at":"2026-08-03T04:47:12.844303Z","submitted_at":"2026-05-24T12:41:34Z","title":"X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T00:18:33.150920Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2605.25044"},"observation_digest":"sha256:bd1e3458e86dac5c592987df978ca36e1bcbccc69d8429cb8ffbc1dffbb29335","observation_id":"49532d25-3f22-4a72-8dab-b506fbdd8490","resolution":{"observed_at":"2026-06-30T00:24:04.245487Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2606.08530","last_updated":"2026-06-10T13:54:28Z","snapshot_observed_at":"2026-08-03T02:29:07.838991Z","submitted_at":"2026-06-07T09:23:16Z","title":"GEAR-VLA: Learning Geometry-Aware Action Representations for Generalizable Robotic Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T18:29:07.758804Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2606.08530"},"observation_digest":"sha256:6ffd027e5fbe9d2ec12fba74bf896241a637c67d1848649aba2f02a0756744a6","observation_id":"ce774114-fb29-4aa2-a04a-1215728dc4a6","resolution":{"observed_at":"2026-07-02T23:07:26.804241Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2606.20092","last_updated":"2026-06-29T12:49:53Z","snapshot_observed_at":"2026-08-03T01:42:23.549465Z","submitted_at":"2026-06-18T11:11:37Z","title":"EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T18:02:47.479255Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2606.20092"},"observation_digest":"sha256:517e9cdad3a921c3f0a7cfaa98a301a3c34bbab6adee641dc0c93a3264e820a9","observation_id":"8910a199-a8f9-453f-8974-688006cc6658","resolution":{"observed_at":"2026-07-04T03:29:30.077001Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2606.20092","last_updated":"2026-06-29T12:49:53Z","snapshot_observed_at":"2026-08-03T01:42:23.549465Z","submitted_at":"2026-06-18T11:11:37Z","title":"EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T10:48:57.031494Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2606.20092"},"observation_digest":"sha256:adc113e6342d577e7b827752a08b44dbe20c1781c78ca30458e8c69f228ab832","observation_id":"098f634c-10c0-4a8f-a070-24fb36e05aaa","resolution":{"observed_at":"2026-06-30T10:54:36.619803Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2606.23623","last_updated":"2026-06-22T17:19:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-22T17:19:03Z","title":"dVLA-RL: Reinforcement Learning over Denoising Trajectories for Discrete Diffusion Vision-Language-Action Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T08:11:41.429127Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2606.23623"},"observation_digest":"sha256:a19911956798cafee8e032d80a10059d6f38eccf4b15f35db9cad169ae3f59fc","observation_id":"f503bf56-ad00-4a75-a410-c18b326edc5f","resolution":{"observed_at":"2026-07-04T10:59:46.980968Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-07-12T09:22:06.947773Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-02T14:24:23.187164Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.00678"},"observation_digest":"sha256:9464dc24db0ac4db120b1e80fdb0d9de87b6ce7350469910a592b781551edf28","observation_id":"4a96de8e-0885-4e10-8122-51956b5cc68a","resolution":{"observed_at":"2026-07-02T14:27:03.181386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-12T09:22:08.000379Z","title":"Discrete diffusion vla: Bringing discrete diffusion to action decoding in vision-language-action policies","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-07-12T09:22:06.947773Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T09:22:08.000379Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.00678"},"observation_digest":"sha256:ef6fa790dc9b5186a26085d5524b3b69456435d14fb9f2dd6b9af3649ae1f4d3","observation_id":"93cd48ac-97ad-4825-8109-1861f98ba987","resolution":{"observed_at":"2026-07-12T09:22:08.000379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2607.01067","last_updated":"2026-07-01T15:26:26Z","snapshot_observed_at":"2026-08-03T00:56:59.776196Z","submitted_at":"2026-07-01T15:26:26Z","title":"Human-Centric Transferable Tactile Pre-Training for Dexterous Robotic Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-02T11:18:32.259684Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.01067"},"observation_digest":"sha256:17fd59a7a774d903166b4e170757d387771472ac10f7bf079100ae061ec0d3a4","observation_id":"e8cfcf2b-0807-45a1-8136-fcf40da549ab","resolution":{"observed_at":"2026-07-02T11:26:53.974972Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":"2508.20072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-04T10:59:46.979599Z","title":"Discrete diffu- sion vla: Bringing discrete diffusion to action decod- ing in vision-language-action policies","venue":"cs.CV","work_id":"33a64891-124d-4530-ab4c-056d66b706d6","year":2025},"citing_paper":{"arxiv_id":"2607.01586","last_updated":"2026-08-04T17:06:56Z","snapshot_observed_at":"2026-08-06T18:55:06.479680Z","submitted_at":"2026-07-02T01:38:16Z","title":"VLAFlow: A Unified Training Framework for Vision-Language-Action Models via Co-training and Future Latent Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-03T17:08:38.538596Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.01586"},"observation_digest":"sha256:bed939694bee5986a9305d3f1046c8eb4e9e8eea45b385bcda3250159b561eac","observation_id":"fd9bbbbb-b19e-4ee3-b268-6e7b2e7e34e3","resolution":{"observed_at":"2026-07-03T17:08:42.684953Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-11T13:05:32.374206Z","title":"Liang, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04816","last_updated":"2026-07-06T08:50:05Z","snapshot_observed_at":"2026-08-06T09:25:11.270935Z","submitted_at":"2026-07-06T08:50:05Z","title":"CAC-VLA: Context-Gated Action Conditioning for Vision-Language-Action Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T13:05:32.374206Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.04816"},"observation_digest":"sha256:ddc7169a8f90af774e77c57ae33cbccf1a874d9b07eea9717b7d1d02f3dc8736","observation_id":"063cba2c-47ac-43c2-8e88-d54c0a002beb","resolution":{"observed_at":"2026-07-11T13:05:32.374206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-11T14:23:57.266710Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05468","last_updated":"2026-07-06T07:10:22Z","snapshot_observed_at":"2026-07-11T14:23:54.006633Z","submitted_at":"2026-07-06T07:10:22Z","title":"Learning 4D Geometric Priors for Inference-Efficient World Action Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-11T14:23:57.266710Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.05468"},"observation_digest":"sha256:a8617b3e902ee2bbb83b641b8455feed747120712c0d042ef9c1c969b6fe1a46","observation_id":"bca56f83-ba4c-40d0-906d-4485b8fd6a26","resolution":{"observed_at":"2026-07-11T14:23:57.266710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-14T15:19:27.489381Z","title":"Discrete diffusion vla: Bring- ing discrete diffusion to action decoding in vision-language- action policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09818","last_updated":"2026-07-10T07:06:02Z","snapshot_observed_at":"2026-07-16T23:18:02.667998Z","submitted_at":"2026-07-10T07:06:02Z","title":"TS-Mask VLA: 2D Temporal-Spatial Masking for Vision-Language-Action Model with Effective Bridging","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T15:19:27.489381Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.09818"},"observation_digest":"sha256:0aba0976405c84365753e88c464f63a8f3cc9edc4102bede7c57664126775ad6","observation_id":"1b267005-5ab1-44ed-97b8-954325acfd22","resolution":{"observed_at":"2026-07-14T15:19:27.489381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-02T00:57:41.909520Z","title":"Discrete diffusion vla: Bringing discrete diffusion to action decoding in vision-language-action policies.arXiv preprint arXiv:2508.20072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14852","last_updated":"2026-07-21T06:49:06Z","snapshot_observed_at":"2026-08-02T04:15:16.437644Z","submitted_at":"2026-07-16T11:22:06Z","title":"Towards Human-like Physical Intelligence: Lifelong Vision-Language-Action Learning for Robotic Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T00:57:41.909520Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.14852"},"observation_digest":"sha256:c99856c030ebc880526ed8f2a41f018bd22625f62dede8a5e90994c6ca24b117","observation_id":"f4e12658-d377-4652-acaf-556b08b76456","resolution":{"observed_at":"2026-08-02T00:57:41.909520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-01T08:52:41.061975Z","title":"URLhttps://proceedings.mlr.press/v270/li25c","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21670","last_updated":"2026-07-23T07:04:51Z","snapshot_observed_at":"2026-08-03T07:39:40.130097Z","submitted_at":"2026-07-23T07:04:51Z","title":"Ordered Action Tokens for Visuomotor Policy Learning","version":1},"reference_index":3728,"source":"pdf_text","source_observed_at":"2026-08-01T08:52:41.061975Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.21670"},"observation_digest":"sha256:1f47d255f5166544e5d4b795eeb54a07d1cb6b1620b8a63d6e1396d83d066203","observation_id":"a50c1645-4c91-4930-964c-cb673e54e935","resolution":{"observed_at":"2026-08-01T08:52:41.061975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-31T23:36:28.362956Z","title":"Discrete diffusion VLA: Bringing discrete diffusion to action decoding in vision-language-action policies","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23909","last_updated":"2026-07-31T13:02:33Z","snapshot_observed_at":"2026-08-06T06:28:25.511411Z","submitted_at":"2026-07-27T00:55:10Z","title":"WorldDiT: A Unified Diffusion Architecture for World and Action Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.362956Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.23909"},"observation_digest":"sha256:a3a340c9d73f94fe7cb0c2d2855cd4f619eab30373442cb7835d67eaf2d31e87","observation_id":"93e44a9e-ac4f-4c53-8935-6c78c52ef55f","resolution":{"observed_at":"2026-07-31T23:36:28.362956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-03T01:48:45.578890Z","title":"Discrete diffusion VLA: Bringing discrete diffusion to action decoding in vision-language-action policies","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23909","last_updated":"2026-07-31T13:02:33Z","snapshot_observed_at":"2026-08-06T06:28:25.511411Z","submitted_at":"2026-07-27T00:55:10Z","title":"WorldDiT: A Unified Diffusion Architecture for World and Action Modeling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T01:48:45.578890Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.23909"},"observation_digest":"sha256:284e2b5a70d654482551584528ac071124f6ef2d4ec9166da69249f205f5c8d2","observation_id":"6bb4fb0c-7272-49b4-b31f-7e5a816ff1d5","resolution":{"observed_at":"2026-08-03T01:48:45.578890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-07-31T23:29:10.917183Z","title":"arXiv preprint arXiv:2508.20072 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23969","last_updated":"2026-07-30T13:06:27Z","snapshot_observed_at":"2026-08-03T18:36:45.105550Z","submitted_at":"2026-07-27T03:36:45Z","title":"LeapBot-WA: World-Anchor Action Models via Predictive Latent Alignments","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-31T23:29:10.917183Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.23969"},"observation_digest":"sha256:7193af8447b19221cb46814a2fa1725a0938e25de9e52e1ae330144849b4533c","observation_id":"6bee72de-6074-4110-b49e-f341aa860f36","resolution":{"observed_at":"2026-07-31T23:29:10.917183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-01T02:18:08.231303Z","title":"Discrete diffusion vla: Bringing dis- crete diffusion to action decoding in vision-language-action policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25516","last_updated":"2026-07-28T09:56:42Z","snapshot_observed_at":"2026-08-05T12:33:40.124969Z","submitted_at":"2026-07-28T09:56:42Z","title":"A Causality-aware Infer-diagnose-refine Framework for Test-time Modality Adaptation in VLA Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T02:18:08.231303Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.25516"},"observation_digest":"sha256:b26c7f0a0858a5ccc074760b121e158187eb328533f5ce5f043d143b01a21d8b","observation_id":"cc89b8a8-6d32-40fd-8e06-a956447cd050","resolution":{"observed_at":"2026-08-01T02:18:08.231303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-01T11:27:05.732909Z","title":"Discrete diffusion vla: Bringing discrete diffusion to action decoding in vision-language-action policies.arXiv preprint arXiv:2508.20072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26657","last_updated":"2026-08-03T03:05:35Z","snapshot_observed_at":"2026-08-06T18:47:56.213025Z","submitted_at":"2026-07-29T09:17:33Z","title":"Enfold: Folding World Model Imagination into Predictive Representations for Ultra-Efficient Embodied Control","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T11:27:05.732909Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.26657"},"observation_digest":"sha256:b9b36a6da9651a79bf85f61f1ce34e7dad6945b95595d68db5177c88f4766eab","observation_id":"5e6e1f3c-49bc-4e36-b99f-a9f09eaadb59","resolution":{"observed_at":"2026-08-01T11:27:05.732909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-04T03:23:46.429140Z","title":"Discrete diffusion vla: Bringing discrete diffusion to action decoding in vision-language-action policies.arXiv preprint arXiv:2508.20072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26657","last_updated":"2026-08-03T03:05:35Z","snapshot_observed_at":"2026-08-06T18:47:56.213025Z","submitted_at":"2026-07-29T09:17:33Z","title":"Enfold: Folding World Model Imagination into Predictive Representations for Ultra-Efficient Embodied Control","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T03:23:46.429140Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2607.26657"},"observation_digest":"sha256:3592b1fe920758b4ad0fed5fe30ba58cd54e516b9e0e3003e650aff431c6b205","observation_id":"822d4a33-ec8d-4d23-8bcd-4b999eaffa73","resolution":{"observed_at":"2026-08-04T03:23:46.429140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-06T00:40:57.295726Z","title":"arXiv preprint arXiv:2508.20072 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01035","last_updated":"2026-08-02T06:45:16Z","snapshot_observed_at":"2026-08-06T19:21:25.704123Z","submitted_at":"2026-08-02T06:45:16Z","title":"WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T00:40:57.295726Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2608.01035"},"observation_digest":"sha256:a675801ab5d779eb95d07b2b1caf17fe420f1fa340408e3213cef591ff78fdd3","observation_id":"18f30567-3fe9-4511-9fb7-bd172dcd16aa","resolution":{"observed_at":"2026-08-06T00:40:57.295726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.20072/citation-record","integrity":"/paper/2508.20072/integrity","json":"/paper/2508.20072/citation-record.json","paper":"/paper/2508.20072"},"outbound":[],"paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 46 inbound Pith citation observations for arXiv:2508.20072."}