{"as_of":"2026-08-22T11:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53d9270fd874469d8895dfd25b4cbd4d5ba68e07a220c2d69096c2368062292a","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T15:16:38.426751Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.04681/citation-record","integrity":"/paper/2607.04681/integrity","json":"/paper/2607.04681/citation-record.json","paper":"/paper/2607.04681"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Adcock et al","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:d17e118d9bb8337a4241af30286292c72ad08c04c7f837c230e6d4b161a3f3ee","observation_id":"59becd2d-c83f-42e9-b805-bea35fc4dfb5","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08679","last_updated":"2026-06-16T17:36:22Z","snapshot_observed_at":"2026-08-16T12:51:00.810519Z","submitted_at":"2025-03-11T17:56:30Z","title":"Chain-of-Thought Reasoning In The Wild Is Not Always Faithful","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08679","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Arcuschin, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2503.08679","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:e3546da3184eac936a0757d45e6ea62c9457ad8b17428e76713e94a048b3ac30","observation_id":"b2add7b3-a570-4564-b51a-b01d972bd8da","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Bai et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:2b573a4de7774f8c72c05f2acae8e4613d725263cdd0878e14f14a9fe6a7b849","observation_id":"8505997b-5883-424f-a2ff-81f01ad22a04","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:f10029e110fc7eed9bac4a7b86d1c154f3b73df4892fa3ec6a17b0703d8c5598","observation_id":"58d10907-4e89-428f-9d19-a27ddeb551a5","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Bommasani et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:193c301b0c907503b833d9acc315ab83ff3ac6457458a8242e2b6bdaed0e3c86","observation_id":"0934f36d-464e-44f0-959a-2bbcb979de92","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08243","last_updated":"2025-05-17T21:04:22Z","snapshot_observed_at":"2026-08-18T01:42:20.495799Z","submitted_at":"2025-05-13T05:35:00Z","title":"Training Strategies for Efficient Embodied Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08243","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Training strategies for efficient embodied reasoning.arXiv preprint arXiv:2505.08243, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2505.08243","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:dad15a4f90e98f5937b2953c6a1f4f094a8a944f0d808ac8191805e2ff3b668c","observation_id":"9f03ab37-eb46-4b44-8256-c570f73bfebb","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset.ArXiv, abs/2403.12945, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:306ce3373da40746715d4686c700707294b6bfaba3f82efcd5ce4963c49b149f","observation_id":"2a56f1c7-aad9-4b6a-bd54-1beddb224afb","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"π0.5: a vision-language-action model with open-world generalization.ArXiv, abs/2504.16054, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:e6b4d4d02fff823467f9c2d841c513737b6c358630ca811f7a56173d66f5d7e9","observation_id":"5b89ce2d-48c7-415c-9d64-4da8195ac4bb","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-08-13T18:02:27.155379Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Measuring faithfulness in chain-of-thought reasoning.ArXiv, abs/2307.13702,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:a0b8244480e2d56512fab667de6083f11efea3350c636897abf22908d1953bba","observation_id":"7a1858d5-8a9a-42f2-abec-264c02c50d1f","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:6176ba6b2394111040e6676913561fc2676c6a26da3649a246590c83ddd67df2","observation_id":"f7a9e730-6b95-41a9-9bf4-eca606caa17a","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/fampra/cmaf043","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Causal mediation analysis: what is it and how can it be used to inform practice and policy?F amily Practice, 42 (4):cmaf043, 2025","venue":"Family Practice","work_id":"4849b332-2384-4534-bb88-f3d3fbdfa3f7","year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:57f34d9c356e065887a5c87c2f0bd14642880565aedeb9007399b9a2a866e1d8","observation_id":"15700273-aeab-45c6-8822-671b470f6696","resolution":{"observed_at":"2026-07-11T15:18:04.905873Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-12T04:19:07.540734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T04:19:07.540734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Self-Supervised Bootstrapping of Action-Predictive Embodied Reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:03d7a19cf3479b3c45ebcae3e1b8d3f4a7508bb8c54f8a57c5ae14995b3eb30e","observation_id":"32205c95-6c99-414d-9213-398659780d7a","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Steervla: Steering vision-language-action models in long-tail driving scenarios.ArXiv, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:3b340de5b22d48ea536125edb694c4bfca946a42f6513b0528b17e5a75758d72","observation_id":"5991609d-9244-46ce-8647-ac804cd7fe62","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Gemini 3 pro model card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:cb295f40dc69e689a8b5992be1c9b5ed97f1dc9bdec8e25d670c8c8a9a0a3afa","observation_id":"f5ba1a44-2e84-4718-af7a-26ad0d3762bf","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:e11280ebcb4c09b3f436c4916f80ecec1f98a4b4be27376896ab98474e0e11e3","observation_id":"ebec0806-5122-463d-836e-71704aacc807","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:1b2e716802f3639124aeec7396a708142f3696a44e57ba381535e182fcbb7109","observation_id":"7832d5ba-701a-4e5c-bacd-e0590e780df0","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24290","last_updated":"2025-07-05T09:01:04Z","snapshot_observed_at":"2026-08-12T18:49:18.486177Z","submitted_at":"2025-03-31T16:36:05Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24290","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Open-reasoner-zero: An open source approach to scaling up reinforcement learning on the base model.ArXiv, abs/2503.24290, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2503.24290","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:b8cb15412f2f4ba7f545754b7a692b978f397bee8e4722a006cae56422065859","observation_id":"e55bbd24-bd90-4653-9a2a-cee48832dbab","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-21T08:56:38.112795Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Hwang, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:b4fb62a80d9af3b090b17d41733f9147e180154484247155e748c1b84ec38ea4","observation_id":"83df1372-54bd-464c-8cc7-72e5422218f4","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07608","last_updated":"2025-03-10T17:59:42Z","snapshot_observed_at":"2026-08-17T14:53:53.844304Z","submitted_at":"2025-03-10T17:59:42Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07608","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Alphadrive: Unleash- ing the power of vlms in autonomous driving via reinforcement learning and reasoning.ArXiv, abs/2503.07608, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2503.07608","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:33a37ba535ac5339ddd83e110047e0f00ad2a14411847fe5838b63c6d72b6418","observation_id":"62c1ddd7-8b59-4d74-b6a2-06d2e52b30cb","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Farrar, Straus and Giroux, New Y ork, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:455819753a4dd54f3509ffd1e003e614c078f87dc82284a52757fec89be23407","observation_id":"4def6bae-e3ce-4981-a6d0-5d030e46cf22","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:22593b7df3aa43973bed531bc8eb2a26150b421b5d4da1528b9c89b368583bad","observation_id":"3739ccfa-323e-4a89-bfb4-6bf18b58fd85","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18234","last_updated":"2025-06-23T01:57:14Z","snapshot_observed_at":"2026-08-15T20:25:25.333235Z","submitted_at":"2025-06-23T01:57:14Z","title":"Drive-R1: Bridging Reasoning and Planning in VLMs for Autonomous Driving with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18234","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Drive-r1: Bridging reasoning and planning in vlms for autonomous driving with reinforcement learning.ArXiv, abs/2506.18234, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2506.18234","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:45196572c4d18d8ec9345777c157ef70ff502fad747f8311b128f4983c42e9d3","observation_id":"5e627be6-bebe-4692-bf7f-d1fd0392d460","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Adathinkdrive: Adaptive thinking via reinforcement learning for autonomous driving.ArXiv, abs/2509.13769, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:17b5209f7f0ad3761bbfd7501b990bceb786db724e8978bc5bc81710588eed1b","observation_id":"8d690813-786a-4f0a-be09-4b11d568c2de","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Walk the talk? measuring the faithfulness of large language model explanations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:b2ba3d4995c22f3b4ff2258c4a06f9baa04d189a0f1b6b50aafee4a57f408ee3","observation_id":"e00d5949-55fe-4a93-8bbc-99c298d1c94f","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Introducing nano banana pro.https://blog.google/ innovation-and-ai/products/nano-banana-pro/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:0ad80662ce6383fa90fe644aa93b5aa49934ce0d5487186c4bbe550b45c0ddf3","observation_id":"d13445b1-dcc8-4855-8d63-a0a4473c2ad3","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Bjorck, F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:ddf546337dc4d3ed12eed561a3120d6ec61a742e45c03ecdca059df35c591671","observation_id":"d4d8d77f-0619-4ff5-9f5c-716e6dfdd6f6","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00088","last_updated":"2026-01-07T09:09:57Z","snapshot_observed_at":"2026-08-16T04:26:38.567252Z","submitted_at":"2025-10-30T01:25:34Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00088","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Wang, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2511.00088","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:c88e5c497f34e1010626b7da5a2227bac1c3f595fde0fd23d8b0eee1290c9757","observation_id":"33032834-7c0b-4b67-becb-11e8a9b0dbde","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"O’Neill, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:088449fb232ae2ef36b4e7613674f7abdf49653b3b5826a844bd39468da3dd4a","observation_id":"d38ccb16-86a7-402a-bffe-e02fc27a3572","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:fc29ba820303f48141e9689e94243c01be1a3cc4e9df0d62744a2e95fe9d102e","observation_id":"32568801-5ae9-438f-bae0-d32fb245c6cb","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:15c0161be83c7a68b4a6950aad6a3a681e0178c28809f7f888cd46084a387caf","observation_id":"15b8e7a1-56fa-46bf-8a90-d72476ea50a8","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Radford et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:a000e71cff2f308a2584ba6b6def20ab6c4e3de9bb481127134e07aef49251ff","observation_id":"57a7f535-3dc6-4899-a207-9bf396c18f48","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Simlingo: Vision-only closed-loop autonomous driving with language-action alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:f9515dce522be66acd57423bf90999414011e3758b6d3b527b9c5e875d7e1593","observation_id":"c412f1e5-7b95-4213-82d6-6bc9892d02d8","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:82438f91a89add940ce84846f7023e43333bb17593b1280bca0ce1c91d819f7a","observation_id":"48cb91bd-1d46-478c-b2e7-98fbc4e9a3a6","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"FRIT: Using causal importance to improve chain-of-thought faithfulness","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:a5534c83d39c95599718160056af2a6d845ad20b1c4a984b289064eed7129f83","observation_id":"f2bfb014-4acc-478a-93c6-668f0b9faee9","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:3fed8c37070f099fdd6807013d74aa616aa90f4a649a7073962b485fc01be67b","observation_id":"7507a634-dd1a-4378-8b8a-96c709d04516","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-13T04:40:33.458745Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Gemini robotics: Bringing ai into the physical world.ArXiv, abs/2503.20020,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:7b7ff80c010a1b991a4eeb77dba35ef05236a136ad9793b777c77246914e665c","observation_id":"0fc73ddb-1485-4317-9128-03c0328ff9e8","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:3db2ea157b3d3117f7f114309a0243f8c1a6c25aa48312ea6af4ce2e9c52d98f","observation_id":"0e347a62-4ef7-4896-9962-5e60fe2fc9e1","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Turpin, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:f3d093fd67a7283524afd9614a5a2267d6b63a46cb6eb00b613438731b4ff4df","observation_id":"20b19be3-521c-42d9-9356-9f2066bb847b","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Wei et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:ce5d133c26cc5be12e6b6aa1e6b91687e7da1f82af1d8939c9d765cdd4174251","observation_id":"881d2d06-8665-4e87-9174-bbf1c5126a14","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Do what you say: Steering vision-language-action models via runtime reasoning-action alignment verification.2026 IEEE International Conference on Robotics & Automation (ICRA), 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:83258041d0cab6c4ce607dda9be2a75b616b4971c63e426d69157b8d2957f384","observation_id":"2fa9b589-4b6b-4dae-980f-86721d84806c","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Xu et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:073b9da832948a0d113ebc391662b8cf1a8a160818d2402a8e76a93d6edcff33","observation_id":"9e3f58e0-1a1d-47cc-84e4-84849bd3a4c6","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"RLPR: Extrapolating RL VR to general domains without verifiers, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:8196c6dd3f5a6e37b70674fd0c139f6ab7b0c279d02e43a7f82df148f1818dfb","observation_id":"51627424-b29d-46ae-aaa2-4ce4e4984e62","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Zaman and S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:d830bf8fb0414cf83f7bf5e721ebc0170d634540654a620601602070c1f9ab1b","observation_id":"9d1b7d64-0dd9-485e-9066-52d678431d03","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08693","last_updated":"2025-03-06T19:29:03Z","snapshot_observed_at":"2026-08-07T02:44:43.738657Z","submitted_at":"2024-07-11T17:31:01Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08693","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Zawalski, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2407.08693","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:7049b01730451eeeb1121514b1280fda751eb2fb100b610d7a389cf64603ff21","observation_id":"05a5a187-f7aa-45b9-bca5-a1a963cf1a89","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:31d2294d0500d0c2b9e0b330c7778f5c8e025b32948a0ddc62fe3b353584914b","observation_id":"d68d0e63-98ff-474d-a3e4-971533654fb6","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13757","last_updated":"2025-11-05T23:46:20Z","snapshot_observed_at":"2026-08-14T00:40:02.694887Z","submitted_at":"2025-06-16T17:58:50Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13757","snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Autovla: A vision-language-action model for end-to-end autonomous driving with adaptive reasoning and reinforcement fine-tuning.arXiv preprint arXiv:2506.13757, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"cited_paper":"/paper/2506.13757","citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:6fe2e76c85b8c29621f7f9e104c56ba8b3836173a8825da3f5a949eeb2a74530","observation_id":"b5363671-51f4-4f32-8b7e-39526b95f3bb","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:77015159b8a81b0f4e53f93185a95baaa657d7f2a17bb87f91bd34ef44fd9ce5","observation_id":"b9b47488-16f4-4a2a-8d0b-024c5769a139","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:b1d75360d85f82bc2c11ce890cba7179676bea2b1e5c456e32338b50638efc3e","observation_id":"c7667154-afe1-4902-98c3-6afa06fe45d3","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:1c8f1982f07568d73a090dee8f7696fcdb83abe3d401456f7dafd2e6908474ba","observation_id":"0a028bca-0582-4f91-9d09-a668ab99fc27","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:efac5d45041af4786db3220f536a6b7756293b841d4f3732f5954f3bb4abf27f","observation_id":"0956c82e-4e0a-4607-bef9-4971e0ca2c0a","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:f6150e5d19950d81b3d304118ac2fec7009d81ec41a843258687d7ce6b19150f","observation_id":"e4680517-34fb-410f-81af-cbc55af224d3","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:01b206431a08161aa77f00c9aa1597b09abb7d93be257ee3f94cad44f4cd8258","observation_id":"7052043b-e3cd-4e96-bd7a-512231fa3448","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:35dddbc2934633094188aee0a3b7684e025c03bcff88797d20b5a8f77a6ab763","observation_id":"e89aa592-b07e-448f-a3f5-c07bc53dbba8","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"LATERAL TAXONOMY (assign the MOST SPECIFIC bin): 1a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:e978413b5063e815558f9c84970c762fea4c4167018810279c184be52c3b2ada","observation_id":"8f4dfc00-0e54-4319-8fe6-83ae63bca909","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Out-of-lane nudge left 4b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:e782de4ab41890f6611015fcb49b4487bcce2ad45452505e77c524fccbf2b83e","observation_id":"18c4d946-2b27-4801-a654-b7455f90217d","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:3f258ad30642e42f9e1bfdfe43fc150b71b0787122fbfa069e435b47b826df36","observation_id":"31951052-5ab8-42ad-9486-af555ce5d3e7","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:44636d17c917a1273d30bbe0a3108edb6cb11b061cd40a529a2e66b9702a5fc5","observation_id":"01f56467-2e89-4714-8f97-a1f5120b02d0","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:fb04fcdd75e6ecca7edfa338b0e7ec21d5a65f6e84e1f6936a892566cd0159ca","observation_id":"84f61245-d124-4387-893f-1f4d914889f6","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"The vehicle is approximately 1.5--2 m wide","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:439966f76715dfdf6c7ecdbd025fc00bc91b42e8778f902b76d6b7aef83b9ca6","observation_id":"b8a20f8e-f50b-4bfa-84c5-d0ff880f19a7","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:85a30963a4baf97a1c995311155aa103370aaba3c84bb2b0e0518ee5b1325d0b","observation_id":"d9d69632-9172-4bef-b557-67cdc314b007","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Do not introduce obvious non-sequiturs or unrelated content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:415490ec6a95704c455ed16d9e22c668b1cb5fec4230e96d22129f0599f01455","observation_id":"33baf8bf-8341-498d-8dcf-1c37b008d534","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"red light","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:ea9c9223d0ee28037621ec5b084252ffb9177580a3bcc4948833480e356e0a82","observation_id":"37e2df8c-f9d3-4590-8a5e-ecdf66fc12e0","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Do not introduce additional inconsistencies beyond the one specified","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:cc8d62048c2856bb94bc32353aa0cb11990751f5af2205e8f8c2b41864bfa879","observation_id":"a7b61733-2d86-4439-9e3d-de099dabc43c","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:41fc5df0d3a3a0def7cd3c290c1e8332fd8444ad8c92650a9387e6c7eaf0e65c","observation_id":"4f06313d-6c62-46b4-ba62-dbc7ec04ffee","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:f46beb9e9cce46198a5bba6d6109f856538a09bb6fe80d1d380a115e637c1fc2","observation_id":"50c3455d-c3b2-48d1-96f1-9f70eb16c4de","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:71aa7024316c2792f0d35d153c4f70efbdc804a327f90124357d0c64688713f8","observation_id":"c027de74-38dc-4827-867f-5d0479d234ae","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"Both single-axis and two-axis flips are valid","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:23a7aba0a41514cebfaf7635334f5ef8d157cfc7d9e297bcf81d1b27f02545ef","observation_id":"fe310f69-d3b7-43ac-8df6-fb937090e071","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:0d64b606d4b3c62fad2cb1a3af2bb29bd80c5a27fff5e2665386c21edc72e014","observation_id":"2c8ce98b-0125-4d6c-9869-7d85f4ff6ea0","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:80e6e18727a5bf4106fe6d34833d595d29ddc213a325760f7e824a8a45084555","observation_id":"1d099c87-1217-48ce-aa5b-74f50dce2125","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T15:16:38.426751Z","title":"\" #! * * ( % # % ) ! %& # % # %!#' $","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-11T15:16:38.426751Z"},"links":{"citing_paper":"/paper/2607.04681"},"observation_digest":"sha256:cb577941c7315c1641900a735cc01e5ca2a0e16d3b82dcdfc4dcc29aa08bdb2f","observation_id":"c48809c5-6714-4156-8b92-042e792b023c","resolution":{"observed_at":"2026-07-11T15:16:38.426751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04681","last_updated":"2026-07-06T05:10:27Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T21:21:26.100900Z","submitted_at":"2026-07-06T05:10:27Z","title":"Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":68,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2607.04681."}