{"as_of":"2026-08-06T03:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:49a2abdabd966e9ec24e640395e520c58cd414f6b580e03c5efc6a058feaae74","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T18:24:22.623163Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.05737/citation-record","integrity":"/paper/2606.05737/integrity","json":"/paper/2606.05737/citation-record.json","paper":"/paper/2606.05737"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:cb85917166c99a58c7717b55d62c2e281e22dedcb2487b00ae18f18d8199b8ae","observation_id":"fa65ccd4-9338-4d88-b1d8-f10c53090536","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:d6d48a6bc9bdbedf1177e055ba5aa8aa4bb8a3f40ae2d59bcb104d7e66c3f97d","observation_id":"21316c94-ad02-4fd6-8292-5e2f91245461","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:63c79c978f1c955c65591492366c06256edbeebb7707896a491126714f9cae15","observation_id":"bcdcdad0-53ef-4c96-9dda-77b3e5f4df30","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:5eb755eb44f0a9bd5088b5272e596069cc57439c8ef5e6ee77b25b0fbbfe3768","observation_id":"d3f91882-1a76-4049-8758-16a1ca4e122d","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:c9965c671783e253368d8323522c9df34e7bc58b7b7a7c9f3a07901c2109d48b","observation_id":"96e923e5-6f82-429b-9a18-b62a311275a2","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Frans, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:a4a17ead404e088b43889d72d0c4192c84fce5c00aab0434f0af5d76dc581166","observation_id":"76cb6fae-470a-4d80-b497-40fe9f76780e","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:3a0ad9dc35b41af7303d433f06d06a9abb6f113652d7e20b26c3eec42c614be3","observation_id":"d87d3b37-dcdb-4229-8eef-a24c903bdaa7","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:05aa9e178c69007773fa6e1d5c3b4c4c5d74a62adcd6fdf2acf20a21d0aaa74d","observation_id":"9229b499-f7bb-4e57-89ba-c46bc22f3438","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Black, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:132850acb583c0e0a2cf8d24ed95afc2167a912b46551473f69cd22e2f2e7747","observation_id":"138aae01-ba7f-4213-bd8d-6edd0a84216f","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:7f2bc9e33a6a5d7215b7494de81256b8438be1d9f20415055b4a1c7fcc17b445","observation_id":"c74b659d-a913-4223-9721-9a26cdf878d3","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Ghosh, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:61a4adc2a2602a1758341e0fa36e3a574054e42b0867b31a50df64211a0aaf88","observation_id":"f2a2205b-14bc-464b-84f7-85284b4af113","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11748","last_updated":"2026-04-15T16:15:30Z","snapshot_observed_at":"2026-08-02T15:24:02.860522Z","submitted_at":"2026-04-13T17:21:41Z","title":"LangFlow: Continuous Diffusion Rivals Discrete in Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11748","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2604.11748","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:6416d6206420ba900cb4d23b699dc5d3bfa933c092ae8c6ad969bee50671e8bd","observation_id":"5a73485a-d5cf-4837-b1c7-c75dac76588e","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:31ec3f77a1030727d8b10ede84625fb0005dd83a1da429ce1574abcb1c4668f7","observation_id":"7b8b1b89-9314-4517-b443-e188b2134b4a","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-07-06T22:32:42.381894Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:d2178416c01459df75aad2959f53d3e12b5a5f9fc428c40754ece8aa691df0e6","observation_id":"a970b029-adf2-4aa2-97ce-c6540ddbefc8","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.03827","last_updated":"2026-05-25T08:44:07Z","snapshot_observed_at":"2026-08-04T11:38:48.693484Z","submitted_at":"2025-10-04T14:56:40Z","title":"LIBERO-PRO: Towards Robust and Fair Evaluation of Vision-Language-Action Models Beyond Memorization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.03827","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2510.03827","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:caf20a457ee944b42598710f3a513814e928f949434b0c5597bbd81bbee9412a","observation_id":"6faf26f1-56b8-4ed8-af64-5d8f336c5ec6","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:0d576880a69d4482a44e0d8a179177a33c005aa54baeea0ed7bea3d88f95c38f","observation_id":"9e6c9b3b-95c6-4776-a060-a2d2e104c47e","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Black, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:ae7945e5ecb77e27770d95353af8660c9ad506b80fb1c945827e61af7487d56f","observation_id":"ab0e3eb8-30bc-44a9-b897-370dfafac66c","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Brohan, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:063e9f7cebc1ea5723ec79d37c0302b67b6bad4dabe06ce5aa0a7f6be799b3e3","observation_id":"ceacb68d-30c2-4a2c-8547-ef23269248b6","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:7f91555d093f5e01d97f27677c627c7fcbd0b836a02d6ee12f07906c9190f2f5","observation_id":"a0344dbc-dcba-414c-b5bb-e62e9789350e","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Zitkovich, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:29bbd1e7c4d96ac3049276489e58ea78a911829edd3cbe58eb55b8790a3bcb04","observation_id":"b9bcb7f8-81c3-4356-9e1b-a63369b6fe78","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:efcb833f71d0922bf73250dbd1577405f98e46c19057910c6ebfe97d69082579","observation_id":"e9c789bf-0d68-4d4f-9d0e-1d30f6d80114","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Pertsch, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:97f143cb3b09052c50d646141e19cf26fbd724d3ab619c248fb1c65ec1a3f9dd","observation_id":"926c7da4-a351-4831-837e-f617ee5f92f2","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:cae8ead1799bb78955251a7db7f2763a5c7d83a657100133dc7d38547109c157","observation_id":"db1fd41d-7da8-4925-96c2-aa9ca1c6b6a1","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:13fd261b670c4a076b66e4a2a2f8dd3952b3918969c1c1d9ef479696e9e79e56","observation_id":"15161b65-d3de-422c-9f37-215918b2f36b","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:34662e2090687cf4e9df9aa5084fdfe18c587b639b0ad29733075976bae8d381","observation_id":"206f9857-0e53-4133-97e5-96d45b658a9b","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:23ba7bc07c72c9d710724ef2e331c4ab486f2534a490ee746fbd4f73c293679c","observation_id":"ec533324-9a9d-4066-b9c4-3407ac745533","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Rombach, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:6c1b07965036a68e243e75bc0067a92fdbdeafa83f3e74f874555603ac2962ab","observation_id":"9ec43bcf-fc36-4d27-8ed2-e16265614ad3","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09595","last_updated":"2025-07-13T11:51:53Z","snapshot_observed_at":"2026-08-04T16:45:16.688465Z","submitted_at":"2025-07-13T11:51:53Z","title":"Demystifying Flux Architecture","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09595","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Greenberg","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2507.09595","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:0c7529e79a8582c87c5b08005c602968877e3404ebbf58c8aac8f07f7f75cce3","observation_id":"1a7920db-2256-4937-af0f-0c09e949f06a","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Dieleman","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:c0821fac1903a2d8839059d112946daf0d85c1ca06e4e60d35e0fbb57c0072b7","observation_id":"bfcbdefc-8b4c-4ef1-abe9-298bb9127f7a","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:12d7797268ad8b6a0aa99edd1c5930e85a98786d098cc2606b2af6fbdee37cf6","observation_id":"03ef6d16-bc91-4858-9e03-28987a87af75","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Bjorck, F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:24b1edc748354af5592518daac1587db9dd53ab9608f0ccdfd843501d35a8138","observation_id":"cf11742e-4d8f-4ab6-903e-1ea1c9402c95","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:e15f55a8788a117b73a88d2409a6146c11a3e5320d8c1894f2475ff84c25c659","observation_id":"9cd7bd53-7f10-4201-85d4-2983e3c0a6b0","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:09259ca26dfa9223cb09e0b74fbd4e93171d1a53e412589b05151c3a24a2a87c","observation_id":"878e58aa-2fc5-4d19-ae90-fe4f08f97632","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:282d1f9b3b64fb5470bf42d477b39c863cc2d3c7f8526e05181b4407e7510eb2","observation_id":"6af2e3da-1c01-40a1-8e44-976a19564cd1","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Raffel, N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:5c72fa6e05bebf459760a3091f7c247aa24df91490321ae9d00841d3c736b931","observation_id":"696f4426-da3e-431d-acb8-0e08669f0e9b","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:a21bdc8f2d2d268f89692f206997a986adb06c9950020199db521f783b650ea7","observation_id":"4b4b58a4-15d7-42b0-8934-6398c5a4d7d1","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:454939ac5143c4db8ef2e2e99de5cff2e79d80a8287462d29bf133ce237ba2a2","observation_id":"ef600a25-6f0d-4169-9e4f-83a0330666e1","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13725","last_updated":"2025-06-16T17:31:16Z","snapshot_observed_at":"2026-07-06T21:43:03.415527Z","submitted_at":"2025-06-16T17:31:16Z","title":"CEED-VLA: Consistency Vision-Language-Action Model with Early-Exit Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13725","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2506.13725","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:2bd38e4c938142fee4e706c70823d1bccb0e0b3ae2859f2f5333ec94ed1a6721","observation_id":"72173b02-b85b-4226-8e25-984d447008cf","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05656","last_updated":"2026-04-07T09:56:03Z","snapshot_observed_at":"2026-08-03T09:33:28.285405Z","submitted_at":"2026-04-07T09:56:03Z","title":"SnapFlow: One-Step Action Generation for Flow-Matching VLAs via Progressive Self-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05656","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2604.05656","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:c9aafa019700b15f4aa2a0a6fd286e66532fbb59b4ab894457b70d2b5b301e4d","observation_id":"837158f3-7842-412c-8e29-2e3f95adaf70","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Esser, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:e69c85b6f74180eac77f97d05cfb47ae77a94ca46020aa48ec115811152bb233","observation_id":"22336cd1-0a1e-4677-a7c5-e3ad443f714e","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Li and K","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:3c9b191b40be4913e0d24266f2c45590f7601a87d63fc0638b2dd597ffdd71d9","observation_id":"ba6ce3ef-aa03-4ecd-b624-aa5db1bd9deb","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Zheng, N","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:6ca4b9a9a117bbc717647223fbac9d88c558140ee25d034138c1878bde487fbd","observation_id":"30e198f1-2923-4e67-bcac-21c0c0f90a6b","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Lipman, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:658c36bf9116a8f71b8a73f6c9766ee738e6344dec1a711a1832fd9bfd98f3f7","observation_id":"06441de2-4471-4c7b-8128-550d9c0b1de3","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:76a0dd643ad11ec0f3da652bf306e9674591bd9b5ccbb8e2b05dc0284296079a","observation_id":"9c720224-8cf6-4894-942f-eb23246c6b7b","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:2129c73399fd9b22d2f6d9933c29d92bc0e00be34e0efe7aee4f3b14563fde6c","observation_id":"3ced1374-5d5d-4f79-9c56-fae073c94283","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"LeCun, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:844239dcaf2c4727539969d7e6f542904400b88a1c82d1340a79ee666d65ba4f","observation_id":"07c012b4-a3a2-4228-8a35-e686ef34b344","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:b17dac1027d88304449d4f6726364cbd0a32c83fb4212598f8fdd2e218e2e28b","observation_id":"9df631ed-af5d-4e2a-a372-e136cce37023","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Krizhevsky","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:6e0679e6e0815dc799409f8cacdefcc9f9c2f8848d8660c87a1ba5c4cdb51b12","observation_id":"3f1d8189-b120-4182-929f-e561a5bd573e","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:78d7fb06ddf916b1610261a39d2ce43c35d09277d24fc33f8d2ab46f94734a85","observation_id":"5ae71e31-d500-415d-96dd-05ebc127b149","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-05T10:06:10.880743Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-07-14T18:24:22.623163Z","title":"Beyer, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-14T18:24:22.623163Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2606.05737"},"observation_digest":"sha256:e3c70c24e402415f23e09a87da9f48c89c3d0056e275d26996bfec0887cad3e7","observation_id":"5a6a2fd0-7a21-4aa1-93c0-8f99dda24dc9","resolution":{"observed_at":"2026-07-14T18:24:22.623163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.05737","last_updated":"2026-07-13T05:29:03Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-16T23:18:44.506203Z","submitted_at":"2026-06-04T05:58:30Z","title":"Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2606.05737."}