{"as_of":"2026-07-29T00:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2a9b4861bbcc8bde462f5cbc65d6c1f1ca7ad4850f634593d8fa4f41116f0975","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T07:06:13.473493Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-28T06:31:03.373048+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06403/citation-record","integrity":"/paper/2607.06403/integrity","json":"/paper/2607.06403/citation-record.json","paper":"/paper/2607.06403"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":"2606.02800","doi":"10.48550/arxiv.2606.02800","metadata_source":"pith","pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","venue":"cs.CV","work_id":"ac5e3265-03db-4f0f-a27f-6d9bea03379c","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:45438db6b875bbd5f3134ed69f961e5d3720693f73369e1520f30fff29456d42","observation_id":"5cfc9951-4d25-4d42-a0ba-7eb2e0803ad2","resolution":{"observed_at":"2026-07-08T07:14:45.485926Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:50.194666+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:50.194666+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":"2506.09985","doi":"10.48550/arxiv.2506.09985","metadata_source":"pith","pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-07-11T02:27:49.493432Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","venue":"cs.AI","work_id":"a9c28401-f16a-4933-89f0-788e2f94e52b","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:b07902589651414bd5eaaf6adc96f5ee3dbd7bc5d31d3e85e7adc8477ae01dca","observation_id":"ad679c6b-c74c-46c5-8811-c36109dc0cf5","resolution":{"observed_at":"2026-07-08T07:14:45.493399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07993","last_updated":"2026-05-19T11:30:49Z","snapshot_observed_at":"2026-07-06T22:57:09.435331Z","submitted_at":"2026-04-09T09:01:43Z","title":"HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation","version":2},"cited_work":{"arxiv_id":"2604.07993","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07993","snapshot_observed_at":"2026-07-08T07:14:45.495383Z","title":"HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation","venue":"cs.RO","work_id":"a4f1182c-7f97-4374-825f-96b01770ccfe","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2604.07993","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:27e8dc40a3e4cc06b3a8dbcb6ece9e42455055da6815ffcda38445c15a5a45e4","observation_id":"003e4f82-c2c8-4c38-9672-109e2ab194a2","resolution":{"observed_at":"2026-07-08T07:14:45.498061Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":"2503.14734","doi":"10.48550/arxiv.2503.14734","metadata_source":"pith","pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-10T23:07:47.672265Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","venue":"cs.RO","work_id":"e2db69c7-ee8a-4cb7-a761-7b8de1dfcf97","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:12818d2ae8e28f91a3a09dc4f2f7111916c629070cfcf27eed6a376cb631d573","observation_id":"f74c6e13-d353-4e0f-8184-eb646ba6a0bc","resolution":{"observed_at":"2026-07-08T07:14:45.502118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.711195Z","title":null,"venue":null,"work_id":"e93d113d-48ef-45c6-b452-0d83de0fb5d1","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:8d3f75d50feb39a970c51ed5f52fd1acbb474ce1fa90742d7a4c1eac4244bc13","observation_id":"86cab0f7-a598-4d4c-b632-021ef85ad981","resolution":{"observed_at":"2026-07-08T07:24:43.712960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.702853Z","title":"InProceedings of Robotics: Science and Systems","venue":null,"work_id":"0d169bf6-2b8d-4d34-8dfb-3fb638981045","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:4c245f6aae3ebc0352587fbdc2d3c2abbf2fd7e0d363bf7efd1e4cefc796ed0a","observation_id":"dda130c9-d3f6-40bd-a14a-ac9bfca4c787","resolution":{"observed_at":"2026-07-08T07:24:43.704491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:07:47.711193Z","title":"arXiv preprint arXiv:2602.12684 (2026)","venue":null,"work_id":"d4ca4245-5a33-487c-83b0-988ef4c60db7","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:cfd959f34d74a872e626f36109f7e089e39d1d62042fac0d33682ce65f9b76ca","observation_id":"91d09b23-e93c-4f91-a230-f1db8a83125a","resolution":{"observed_at":"2026-07-08T07:14:45.505934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15493","last_updated":"2025-07-22T15:04:37Z","snapshot_observed_at":"2026-07-06T22:00:18.950986Z","submitted_at":"2025-07-21T10:54:13Z","title":"GR-3 Technical Report","version":2},"cited_work":{"arxiv_id":"2507.15493","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15493","snapshot_observed_at":"2026-07-10T04:16:48.751910Z","title":"GR-3 Technical Report","venue":"cs.RO","work_id":"7f3b800b-0146-4c37-b178-0801cd4270db","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2507.15493","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:fa3f0d266f93f4674e10c41ca63e16b0ea94662dcb7154dff1ac5e9fd6ea71c5","observation_id":"7d8a7ae8-e647-4482-9483-5308709382ad","resolution":{"observed_at":"2026-07-08T07:14:45.482564Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2606.15768","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.463941Z","title":"Lawam: Latent world action models for efficient dynamics-aware robot policies.arXiv preprint arXiv:2606.15768, 2026","venue":null,"work_id":"c34e3100-0d69-44b3-b033-3fac5e9d64ed","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:c7b9178a7c5c8ca2d220a0972d4ff1af0d107f65989289dbfbb4609a255c26e3","observation_id":"84bce366-b3c6-4b47-aa2e-27f5c335d9db","resolution":{"observed_at":"2026-07-08T07:14:45.468230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-07-12T09:22:06.947773Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":2},"cited_work":{"arxiv_id":"2607.00678","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.00678","snapshot_observed_at":"2026-07-08T07:14:45.470221Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","venue":"cs.CV","work_id":"198dfc69-f4bf-4de4-9c96-1c13b46e30fe","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2607.00678","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:5cf17f4837bfd716721cd93d7532abbd54847cdd61faa36b9d5ff7fb5e38a9f0","observation_id":"49ec92c7-707e-4b92-9041-be7498122d83","resolution":{"observed_at":"2026-07-08T07:14:45.472368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.673631Z","title":"Dexworldmodel: Causal latent world modeling towards automated learning of embodied tasks, 2026","venue":null,"work_id":"195ee403-dfe1-4332-b057-2d7901e9977a","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:79ae66c8b08fe87d3ea74b2f03af4dc15ded212d3e5625001d7fcc828b498248","observation_id":"bc4f3dae-fafa-47c1-ba37-c76f365535c6","resolution":{"observed_at":"2026-07-08T07:24:43.675975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.05693","last_updated":"2026-07-08T05:36:16Z","snapshot_observed_at":"2026-07-11T23:17:55.233064Z","submitted_at":"2025-12-05T13:21:05Z","title":"HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies","version":2},"cited_work":{"arxiv_id":"2512.05693","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.05693","snapshot_observed_at":"2026-07-09T02:19:49.242114Z","title":"Himoe-vla: Hierarchical mixture-of-experts for generalist vision-language-action policies","venue":null,"work_id":"2e3fe795-adc6-4e30-a0e7-d184ea103fba","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2512.05693","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:d2bd90679d39e0e2463bb86be9838fb1a56f8f836a712579f806bb49f0ddf67f","observation_id":"22113d00-53bb-49f0-bb94-23dbbf411775","resolution":{"observed_at":"2026-07-09T02:19:49.242114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.708389Z","title":"Galaxea g0.5 technical report, 2026","venue":null,"work_id":"91a7d7cf-77c8-40e4-b231-61830e023ebe","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:1099d01e258f523128a957177269ce4358af3fed7892b6651e727c4900d9898a","observation_id":"cc3a46fa-a757-4bb3-a01b-df17909688d3","resolution":{"observed_at":"2026-07-08T07:24:43.710268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-07-06T22:21:09.483995Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":"2509.00576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-07-08T07:14:45.460259Z","title":"Galaxea open-world dataset and G0 dual-system VLA model","venue":"cs.RO","work_id":"568af32f-f647-4c11-a106-65ddfa305082","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:2cc6bdcc9541e89e30ccda9d49175627300563c7136621e440b40394fe75214d","observation_id":"853afccb-f2b6-4f39-8a32-ce3bea1f01f7","resolution":{"observed_at":"2026-07-08T07:14:45.462253Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:eb96ed13e9101bcc81fc9d83cb2a70835e8d7999cc2269ee0d6a510881fba9e8","observation_id":"b0d968cf-f23c-4deb-b81d-c421f2bd1c1c","resolution":{"observed_at":"2026-07-08T07:14:45.478990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.679858Z","title":"OpenVLA: An open-source vision-language-action model","venue":null,"work_id":"abec555c-7087-4fdf-bb91-2cea7288e766","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:de2c83b99aff809ca98c85483012d2c5968b2aa4cce4a264bc8c31798cc21d08","observation_id":"10e80ea4-bf94-4929-b266-8784b39cb6cf","resolution":{"observed_at":"2026-07-08T07:24:43.681788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.15169","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.451588Z","title":"Forcevla2: Unleashing hybrid force-position control with force awareness for contact-rich manipulation","venue":null,"work_id":"33f8c9ec-a90b-40bf-97c0-4a8f8adff56b","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:ccef5ce54267ae00fe0c44804cd0457117f072e49d1fffd6f463888a2221afb7","observation_id":"fc61d89c-b1a4-4adc-ba11-40f28e2e2673","resolution":{"observed_at":"2026-07-08T07:14:45.454088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12062","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:26:10.991036Z","title":"HoloBrain-0 technical report","venue":null,"work_id":"ae9c3bee-5775-4997-a93a-47049c7cab3e","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:f7b04fd97dd84f640fbe5adcb7600f70c27f56f55381cbc45f609439b9851d7f","observation_id":"414594b6-6e00-4fa7-923a-6c634c02b9fe","resolution":{"observed_at":"2026-07-08T07:14:45.438202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:9425b1250a28c3e821a836f76e7a9197c585aada5001fefd738eea147979cb9d","observation_id":"7a9673b0-6999-4e6f-9221-507e0d6c44ba","resolution":{"observed_at":"2026-07-08T07:14:45.441802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15597","last_updated":"2025-07-21T13:19:09Z","snapshot_observed_at":"2026-07-06T22:00:23.912390Z","submitted_at":"2025-07-21T13:19:09Z","title":"Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos","version":1},"cited_work":{"arxiv_id":"2507.15597","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15597","snapshot_observed_at":"2026-07-10T04:16:48.668605Z","title":"Being-h0: vision-language-action pretraining from large-scale human videos","venue":"cs.CV","work_id":"5aebd66f-99a4-4264-a778-dd17abb8d446","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2507.15597","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:814eb0576220a40a474c1b7b007e4ba141c6685147cd6f217415fd8b1bcbb8fe","observation_id":"c898bc55-29e6-4ff2-b04c-63542be34257","resolution":{"observed_at":"2026-07-08T07:14:45.445289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.12993","doi":"10.48550/arxiv.2601.12993","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Being-h0","venue":null,"work_id":"2c66b688-268c-4501-bc7a-88376b03d92f","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:26100c7b8ab708b813bdce8a058cb0feacf5931425bf5ced986d0dcf3b018038","observation_id":"6c238041-d146-4740-8dc5-4dd34b9f904b","resolution":{"observed_at":"2026-07-08T07:14:45.449397Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"cited_work":{"arxiv_id":"2605.00078","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.00078","snapshot_observed_at":"2026-07-10T04:16:48.652559Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","venue":"cs.RO","work_id":"acd97985-0a4e-4d72-8d96-a565b720b855","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.00078","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:ec54adcbe4efde008d5dc5e70aeb442d0ac0667e60eeb994a0daecc6e5f12f36","observation_id":"91bcbe7b-0b66-45da-a1f9-82fd7c9fa25c","resolution":{"observed_at":"2026-07-08T07:14:45.425343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12215","last_updated":"2026-06-03T04:04:20Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T17:53:51Z","title":"LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion","version":2},"cited_work":{"arxiv_id":"2602.12215","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12215","snapshot_observed_at":"2026-07-09T22:16:36.379086Z","title":"Chen et al","venue":"cs.RO","work_id":"3871a208-87bb-40c9-922d-9203ad3a857f","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2602.12215","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:3aef25317bbbb9f8471a65a62ea757b340aee67f5eec437454b88bf117c0a039","observation_id":"9c7c5ceb-597e-468c-b36b-ef4f15c62d99","resolution":{"observed_at":"2026-07-08T07:14:45.429695Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11689","last_updated":"2026-04-13T16:30:35Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T16:30:35Z","title":"LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment","version":1},"cited_work":{"arxiv_id":"2604.11689","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.11689","snapshot_observed_at":"2026-07-08T07:14:45.431275Z","title":"LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment","venue":"cs.CV","work_id":"6c1314e7-29f9-42ba-be35-94fb6d627ba7","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2604.11689","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:43e126b40fd9f5fef494d0ba9ccfff0548043ef3b2ea7608cef88dea25665a39","observation_id":"09d20cf5-02cc-40c1-b310-e721e2ea7bbf","resolution":{"observed_at":"2026-07-08T07:14:45.433532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:56:04.954255Z","title":"Qwen3.6-27B: Flagship-level coding in a 27B dense model, April 2026","venue":null,"work_id":"2bf8376a-c906-4375-9261-41d52a22bfb9","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:fab02b311a1ecbb3ebe44bd8d779fd2f1b7e9933f1ff64535a44aa5a9ab72797","observation_id":"a7e6a948-fdb6-4cbc-9887-7506ede97bf2","resolution":{"observed_at":"2026-07-08T07:24:43.693592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.694418Z","title":null,"venue":null,"work_id":"6e8a3436-da04-4188-908e-359164d6bcd1","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:68c00bf5339e70ffd6dd86cf25267d8999ca22a37f1bff034ac2aacfdfc3e973","observation_id":"200de719-b032-4001-99d9-62d85cf3582a","resolution":{"observed_at":"2026-07-08T07:24:43.695786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.685540Z","title":"World guidance: World modeling in condition space for action generation","venue":null,"work_id":"b88638c6-7b51-4f6f-940b-e6b4937025f8","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:fcd9cf38dc46e8e36c8fa4e7629dfdf4e26a89ce586463d0949e12e4c57207ad","observation_id":"a50f5f59-ac4b-4439-9906-daba83719e83","resolution":{"observed_at":"2026-07-08T07:24:43.687497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.676956Z","title":"Masked depth modeling for spatial perception","venue":null,"work_id":"7b81e6de-6b80-4685-8578-aacd6fc714d5","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:cf9600f01e76db31ed33ae79476c508913c8b5110fd551a59329b7b90c172106","observation_id":"1d7926b9-6a1e-44e7-b461-e6af4cac3c85","resolution":{"observed_at":"2026-07-08T07:24:43.678764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.08122","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.404867Z","title":"Towards human-like manipulation through RL-augmented teleoperation and mixture-of-dexterous-experts VLA.arXiv preprint arXiv:2603.08122, 2026","venue":null,"work_id":"db685b2b-f13e-4e70-8d1b-a836e3531459","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:0b3e507451c4b2496ac65883378cec57514eed6fca4e41913c1a6cf80a95a24e","observation_id":"d86c13d0-8e17-4dfe-ac6a-dab771786a42","resolution":{"observed_at":"2026-07-08T07:14:45.408586Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":"2503.20020","doi":"10.48550/arxiv.2503.20020","metadata_source":"pith","pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-07-10T23:07:47.582320Z","title":"Gemini Robotics: Bringing AI into the Physical World","venue":"cs.RO","work_id":"f7c5ce10-8364-4fbe-964f-2802b81c3a98","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:6691ec2a8340da2277283c1291af91934f3d87eeed105064968c8b7bf1904760","observation_id":"f87599c4-14d9-4a46-97d3-26cbd1f2227d","resolution":{"observed_at":"2026-07-08T07:14:45.412977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.699669Z","title":"Gen-1: Scaling embodied foundation models to mastery.Generalist AI Blog, 2026","venue":null,"work_id":"1215b35f-0045-4d62-9237-66b27afb5dcc","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:4db8a64105d50e8f786234b76c9cc29ff57b77fc2f911cbb5b320828bb909a3a","observation_id":"e1815cef-e8cf-43ef-8c62-97586520cf08","resolution":{"observed_at":"2026-07-08T07:24:43.701906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.682691Z","title":"GR00T N1.6: An improved open foundation model for generalist humanoid robots","venue":null,"work_id":"609e320b-ab52-4598-bed0-d62abffa71e0","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:756ebeb58a464e48a6e7b7d60a7765ba363327fc6e19d717e55df4a64d36385c","observation_id":"6fc84b0e-6424-425a-b3e2-68d61766908b","resolution":{"observed_at":"2026-07-08T07:24:43.684694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.705342Z","title":"Qwen-robotmanip technical report: Alignment unlocks scale for robotic manipulation foundation models","venue":null,"work_id":"79fc0c14-5439-4985-b95a-c8bdd0673de2","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:1687d5d403c73b87be2dc3bc3c22edcef457d96ad9f20601e4421ae606c3388a","observation_id":"9a260665-5e6e-4215-bd3a-d4184da1253e","resolution":{"observed_at":"2026-07-08T07:24:43.707305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30280","last_updated":"2026-06-01T13:48:35Z","snapshot_observed_at":"2026-07-06T23:39:34.232661Z","submitted_at":"2026-05-28T17:36:31Z","title":"Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments","version":2},"cited_work":{"arxiv_id":"2605.30280","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.30280","snapshot_observed_at":"2026-07-10T19:47:32.615085Z","title":"Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments","venue":"cs.RO","work_id":"88b299ef-a020-4d77-898a-de62683da6ed","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.30280","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:91a5d7bcee3c764b3104f18ad4dec57bc3e3f52cb78635aa46ce0abab0d87018","observation_id":"e3815cc7-0ec4-4778-a075-b92499ecd99c","resolution":{"observed_at":"2026-07-08T07:14:45.417284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.14349","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.395412Z","title":"Vision-centric activation and coordination for multimodal large language models","venue":null,"work_id":"5eeb69b7-9408-480a-9d98-3671dce190de","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:eb57cd4c2c472ef0d0a98993a1c37bc3184e54cb6107a42094a2e8fa6209322b","observation_id":"dfc55af1-d17c-4f73-bb2c-ae5e12688dc7","resolution":{"observed_at":"2026-07-08T07:14:45.398070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.696729Z","title":"The Great March 100: 100 detail-oriented tasks for evaluating embodied ai agents","venue":null,"work_id":"6edb7d96-4544-4fc1-8a52-fac7f039aed8","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:de039b45e843c624aebe152c8c60df0d6aff1538b92cc0cd78828386f662f08d","observation_id":"e14e13a8-c8c0-411d-8d07-72518703617a","resolution":{"observed_at":"2026-07-08T07:24:43.698622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.688385Z","title":"Videorope: What makes for good video rotary position embedding? InInt","venue":null,"work_id":"db583a9c-55a8-402c-9626-c5a015d37674","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:e628a3435ef6d1ea2b689099351a190d2994a8ed083f4c1c8ed6e1b7b5eb7670","observation_id":"a33f30d5-2454-4287-bcc9-6475f0bd0426","resolution":{"observed_at":"2026-07-08T07:24:43.690508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18692","last_updated":"2026-02-26T03:30:01Z","snapshot_observed_at":"2026-07-06T22:43:02.453697Z","submitted_at":"2026-01-26T17:08:04Z","title":"A Pragmatic VLA Foundation Model","version":2},"cited_work":{"arxiv_id":"2601.18692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.18692","snapshot_observed_at":"2026-07-10T07:26:54.460833Z","title":"A Pragmatic VLA Foundation Model","venue":"cs.RO","work_id":"9b5a37fb-5c5d-4fbb-a804-d518173f2011","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2601.18692","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:dc23cf0dd7f08e5d4e99822c36a6430cb43c45ccb98bc657702ba7b91945c973","observation_id":"fad77dea-ea50-4f54-a5e8-29f3e5b9bfa3","resolution":{"observed_at":"2026-07-08T07:14:45.387940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.716557Z","title":"Hy-embodied-0.5-x: An enhanced embodied foundation model for real-world agents","venue":null,"work_id":"1dcfe1a1-0362-4258-ad3d-d625677d1849","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:6b871fdf62a1ec25aa10a4e8ed56f80f2402b6f616088bab43c01830a423f3bc","observation_id":"826ef41b-3fe4-4b80-82aa-a6989304975a","resolution":{"observed_at":"2026-07-08T07:24:43.718522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.12265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.389717Z","title":"OmniStream: Mastering perception, reconstruction and action in continuous streams","venue":null,"work_id":"cde067bb-54de-4acd-b611-49a821df4a83","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:6efc448f2fcdf65e9b1d9ae6253a1c1c13be7c9e6eb2f384cd95057e06029d14","observation_id":"b24c01e9-c49b-49d3-9a91-7304df6f9778","resolution":{"observed_at":"2026-07-08T07:14:45.393708Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:43.713978Z","title":"Magma: A foundation model for multimodal AI agents","venue":null,"work_id":"46f85f7b-c3d9-483d-af34-d38e228b66e1","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:c558eb71f71eb5114dbad751adb261b516e13fb7756ee2f25212033564d5b4fe","observation_id":"0151f29a-b4ac-4cd7-841c-c12b40ffbc18","resolution":{"observed_at":"2026-07-08T07:24:43.715649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.11236","last_updated":"2026-04-14T10:01:08Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:47:01Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","version":2},"cited_work":{"arxiv_id":"2602.11236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.11236","snapshot_observed_at":"2026-07-08T07:14:45.378913Z","title":"ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning","venue":"cs.CV","work_id":"30745958-0491-4e57-a989-e53b1a7fe19f","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2602.11236","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:588e77ece860ba2c25ca764a2e943ada6f23fd295d8a7eed8bd0274ad8cf9dd1","observation_id":"233158c1-bc37-43e6-9c03-04ddb6cefe9f","resolution":{"observed_at":"2026-07-08T07:14:45.381619Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11757","last_updated":"2026-04-13T17:30:01Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T17:30:01Z","title":"StarVLA-$\\alpha$: Reducing Complexity in Vision-Language-Action Systems","version":1},"cited_work":{"arxiv_id":"2604.11757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.11757","snapshot_observed_at":"2026-07-08T07:14:45.383420Z","title":"StarVLA-$\\alpha$: Reducing Complexity in Vision-Language-Action Systems","venue":"cs.RO","work_id":"12a3a5c8-e654-4f54-af2c-2f58d033ffc9","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2604.11757","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:79c3d289f5c3377fc791f25ca7194a5826f6896514a7ce3755339dd651cdfa22","observation_id":"77d13554-2337-4648-a28b-1f0e9f6599ba","resolution":{"observed_at":"2026-07-08T07:14:45.385142Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.08113","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.400005Z","title":"Samoe- vla: A scene adaptive mixture-of-experts vision-language-action model for autonomous driving","venue":null,"work_id":"85554142-7ae2-4404-9f40-fdb59f003371","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:0e6a948925c84288b4e349fb7463bcf7ac6c2dc16ec9bc64893aa8c2ad11afe5","observation_id":"738073c5-f75c-40ba-aed7-3ee744efdefc","resolution":{"observed_at":"2026-07-08T07:14:45.403016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.22159","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.419065Z","title":"Forcevla: Enhancing vla models with a force-aware moe for contact-rich manipulation","venue":null,"work_id":"0b6974ec-d23e-487a-8190-e895bab17267","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:5a39283cd0f75d6c3ecac670f093cfff86fbc86e9fc2c3c82521aaaac6188faa","observation_id":"7019218b-1805-44b6-9062-ccefc4d59f97","resolution":{"observed_at":"2026-07-08T07:14:45.421603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30877","last_updated":"2026-06-01T02:49:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-29T06:04:03Z","title":"Wall-OSS-0.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.30877","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.30877","snapshot_observed_at":"2026-07-10T04:16:48.754139Z","title":"Wall-OSS-0.5 Technical Report","venue":"cs.RO","work_id":"6386bad8-4e7c-4c42-9ab5-4b6af1f11a64","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.30877","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:9c7f8e839af02cb004c9714216b8b678e29a2283773b21d859afddd2418bdd36","observation_id":"9d0f20ee-5153-47d9-8194-1471d3e15e7f","resolution":{"observed_at":"2026-07-08T07:14:45.374157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.11766","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:42.924974Z","title":"Igniting vlms toward the embodied space","venue":null,"work_id":"a0f111cf-bd1b-4bc6-ad3a-f8ffbc1045f4","year":2025},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:3cb02510de1396a4e7f5359df2e94b9ce1acac1987f9a68c9ce202c0133d85c9","observation_id":"b61eabe8-f1df-46c2-bb7a-665fb8187bde","resolution":{"observed_at":"2026-07-08T07:14:45.377496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07648","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.368441Z","title":"AtomicVLA: Unlocking the potential of atomic skill learning in robots.arXiv preprint arXiv:2603.07648, 2026","venue":null,"work_id":"d7f0a9a6-8928-4e9c-9518-ee5aac4b484a","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:f41f98829085d34b15dc9288129c83efc43c6768c03fed4b0aa25b0db720258e","observation_id":"b610e1b9-44f4-4f9c-867c-890dbb7e5f3b","resolution":{"observed_at":"2026-07-08T07:14:45.370620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.28548","last_updated":"2026-05-27T14:39:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-27T14:39:42Z","title":"GEM: Generative Supervision Helps Embodied Intelligence","version":1},"cited_work":{"arxiv_id":"2605.28548","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.28548","snapshot_observed_at":"2026-07-08T07:14:45.365277Z","title":"GEM: Generative Supervision Helps Embodied Intelligence","venue":"cs.CV","work_id":"8cbd1bec-4e45-408e-8d75-d09023d50911","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.28548","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:6ea727d76cf9b832173d7b77d3e9b2c1cbd4551cafa5b6049de206b4119778c6","observation_id":"5f4a89b6-e6f7-4190-8252-542136a69e98","resolution":{"observed_at":"2026-07-08T07:14:45.366955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-28T06:31:03.373048+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-10T23:18:25.805834Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":31,"verified_fuzzy":16},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-28T06:31:03.373048+00:00","source":"crossref"},{"observed_at":"2026-07-28T06:30:57.601408+00:00","source":"retraction_watch"}],"thesis":"As of 29 July 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2607.06403."}