{"as_of":"2026-08-10T20:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c94f724f11a7cf2c57c701db140e4a357a4936f15400110ac2c364e9a754870","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:30:57.186538Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06434/citation-record","integrity":"/paper/2608.06434/integrity","json":"/paper/2608.06434/citation-record.json","paper":"/paper/2608.06434"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-10T04:30:57.080523Z","title":"pi_0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.080523Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:7f0396702a3430d98b84858c1a912d1761c3b8107ccdea60e23d3c2ecba9d63c","observation_id":"6b8ac8e5-5e60-4646-8e2c-062c225d304a","resolution":{"observed_at":"2026-08-10T04:30:57.080523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.590825Z","title":"OpenVLA: An open-source vision-language-action model,","venue":null,"work_id":"860aab1d-dc06-4957-a9cb-8bda968eaeed","year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.085322Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:d9d22a400c40bf383611e250d2c5ab0f57037b8f95f4c4008b71800d1ec015dc","observation_id":"24055610-e097-462d-a20c-46113355c0d3","resolution":{"observed_at":"2026-08-10T04:30:57.594979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-10T04:30:57.089119Z","title":"Paligemma: A versatile 3b vlm for transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.089119Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:8c2e256bf599bf23c753fcf0d312b51b8d7cd2a0a45886828d92fe162b2e8603","observation_id":"c2182ab2-d6f4-4e01-9c90-5ed195faa706","resolution":{"observed_at":"2026-08-10T04:30:57.089119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.577292Z","title":"Prismatic vlms: Investigating the design space of visually- conditioned language models,","venue":null,"work_id":"1f3c9c6c-3954-4c77-b225-edb914337621","year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.093149Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:e4030ecd5626085a791c98ecc63dbb1d94182025bc8234d694d94a25dd7aa9bf","observation_id":"a462fb4b-e5f4-429e-8836-e63470a39be9","resolution":{"observed_at":"2026-08-10T04:30:57.581553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.564814Z","title":"Bridgedata v2: A dataset for robot learning at scale,","venue":null,"work_id":"6afb98c0-b75d-41e5-99d4-b12e1f14135b","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.097586Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:1a8f388506bfdbe89f6b6a4b6f0b0687781535320784021099ee9b64436c1067","observation_id":"25b9f60c-9ba2-4b52-b42e-b34d1ca85204","resolution":{"observed_at":"2026-08-10T04:30:57.568479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.552926Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0,","venue":null,"work_id":"0e373851-3ddf-4e20-8a4f-4537b28d0156","year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.101400Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:97b68c738e3f19a2ff043bc98af66c1d57506236df25c99f7a1942f362526b93","observation_id":"1b88a691-8446-4cdd-a1f0-b78a74d3d435","resolution":{"observed_at":"2026-08-10T04:30:57.557007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.540412Z","title":"Rt-2: Vision- language-action models transfer web knowledge to robotic control,","venue":null,"work_id":"24b827fa-b187-44df-b95d-2243f28bd0ba","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.105640Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:f9a75bf99e3a772756de1792450404cdd9826f26648217158de0884120215417","observation_id":"1b6610d1-92f5-46a6-be29-b52cdfd96d34","resolution":{"observed_at":"2026-08-10T04:30:57.545411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.528735Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":"932f0c55-38cc-4444-8f76-97e85f435ac8","year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.109431Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:41cedd7ce99bd851c6cc055c75c03f5877fe63efc5965d567d171aef4dfc49ad","observation_id":"2eaac3e3-da97-4d58-ba98-6624712c61fe","resolution":{"observed_at":"2026-08-10T04:30:57.533020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.517028Z","title":"Tinyvla: Towards fast, data-efficient vision-language-action models for robotic manipulation,","venue":null,"work_id":"2157ecd4-5538-4e0a-b909-c7830c9254f9","year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.113080Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:b00df7eed33a6721b62b290716c9539bd81d5fe503adfab317785e79aca09198","observation_id":"6dacd164-f493-4fdc-91e4-dbc1b309435f","resolution":{"observed_at":"2026-08-10T04:30:57.520807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-10T04:30:57.116802Z","title":"Smolvla: A vision-language-action model for affordable and efficient robotics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.116802Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:64dae1058584412716aae231c88929b9af180c51f9921ed845aebee44720dfe8","observation_id":"f61b9e85-b26b-442e-9355-bd06ae258ecb","resolution":{"observed_at":"2026-08-10T04:30:57.116802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-10T04:30:57.121014Z","title":"What matters in learning from offline human demonstrations for robot manipulation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.121014Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:a1efdf12cffc2eb3f0a485c707ea32f0e208e6f4d3451d142356fea380e4aa42","observation_id":"c6565fd2-ef0d-4c45-b94d-83217c37625a","resolution":{"observed_at":"2026-08-10T04:30:57.121014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-10T04:30:57.124809Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.124809Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:b5db892cda26608d6043d1cae27fcf888773144d00bea385d37a8832c245d19a","observation_id":"2d03f803-7772-4f22-9479-70c941ca7341","resolution":{"observed_at":"2026-08-10T04:30:57.124809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.129041Z","title":"Kahneman,Thinking, fast and slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.129041Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:2e9171bf202bafbabc16275ccc942900b0d06754dd0dd2ee709a6c6cefef7a46","observation_id":"57d8cb51-68c2-4772-93d9-b693fa24c531","resolution":{"observed_at":"2026-08-10T04:30:57.129041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15549","last_updated":"2024-10-21T00:36:02Z","snapshot_observed_at":"2026-08-07T13:57:47.043583Z","submitted_at":"2024-10-21T00:36:02Z","title":"A Dual Process VLA: Efficient Robotic Manipulation Leveraging VLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15549","snapshot_observed_at":"2026-08-10T04:30:57.132522Z","title":"A dual process vla: Efficient robotic manipulation leveraging vlm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.132522Z"},"links":{"cited_paper":"/paper/2410.15549","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:a4e71c8754ae5b5325ac74f21bf7240be78ecaef8ac3bf4cd565c593aa3e3183","observation_id":"8096977d-b0d7-4679-a0a5-b0014658544a","resolution":{"observed_at":"2026-08-10T04:30:57.132522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01953","last_updated":"2025-06-02T17:59:51Z","snapshot_observed_at":"2026-08-07T11:28:25.217327Z","submitted_at":"2025-06-02T17:59:51Z","title":"Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01953","snapshot_observed_at":"2026-08-10T04:30:57.136303Z","title":"Fast-in-slow: A dual-system foundation model unifying fast manipulation within slow reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.136303Z"},"links":{"cited_paper":"/paper/2506.01953","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:bd71ddeafd67d2ce60c46c2a50453dd35d7a0d61af7bbf9374c1b88cb549f65f","observation_id":"4fb6c10c-3c9e-45cf-b318-137f3e3c6e90","resolution":{"observed_at":"2026-08-10T04:30:57.136303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.497046Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"bd614453-30e2-4ce6-ae09-d9255fbd3d9b","year":2021},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.139819Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:7e5a0248ef3795c50b32ded102e554be050cfd2b6da7d4c2cc4761d4fadb9af2","observation_id":"91935d68-daed-4bb7-ab58-d627383df95d","resolution":{"observed_at":"2026-08-10T04:30:57.500823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-02T11:48:59.131827Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-10T04:30:57.143068Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.143068Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:89e3d7f024cddf7785e3fbced93b5c06588bf77a2e23db81270c2e2ce2d2e35e","observation_id":"f3827a3e-8029-49c2-9071-fdbd3e27b16d","resolution":{"observed_at":"2026-08-10T04:30:57.143068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.485479Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":"9ec6a043-9aa8-4ed8-b3b2-6d8e22d8472f","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.146256Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:d69ad67907e27df12720316fc2da85d68338418c9e61dec28c2ed59f7be2b8d0","observation_id":"f960f311-c1a1-485e-bd4f-f0bcccadd1b1","resolution":{"observed_at":"2026-08-10T04:30:57.489164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.474081Z","title":"Cliport: What and where pathways for robotic manipulation,","venue":null,"work_id":"1f7ae2b1-93a5-4d66-ac56-6cad73540d3d","year":2022},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.149233Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:0c15fb2e1ff68eb86e1202c5cd4cbb3389bcb5941ae1dfeaf2cfdaa587dcef4b","observation_id":"2bb9d833-b174-4363-870f-37d0d5bd6e88","resolution":{"observed_at":"2026-08-10T04:30:57.478315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-10T04:30:57.152575Z","title":"Gr00t n1: An open foundation model for generalist humanoid robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.152575Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:395d0c9ded7dbc3b6061e932fd1694ab0f0b6dfd417fc464a301575adaf114b8","observation_id":"ba061c9c-76b1-4759-9010-afc74091f8da","resolution":{"observed_at":"2026-08-10T04:30:57.152575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-10T04:30:57.157342Z","title":"Cogact: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.157342Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:edd178936a18602a98decef8d165bd1d7e1cc77791508baf809562447f486e60","observation_id":"9dee8705-7a7f-4a47-8077-0bda59ee13a2","resolution":{"observed_at":"2026-08-10T04:30:57.157342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05273","last_updated":"2025-02-03T04:07:37Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-09-12T09:18:09Z","title":"HiRT: Enhancing Robotic Control with Hierarchical Robot Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05273","snapshot_observed_at":"2026-08-10T04:30:57.162285Z","title":"Hirt: Enhancing robotic control with hierarchical robot transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.162285Z"},"links":{"cited_paper":"/paper/2410.05273","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:76914191229fbc408447b38d8f47e1a84ca1dcac3ee20ca229ae4fbf6bbb5896","observation_id":"af75476d-c011-4073-89e0-bc6234596be2","resolution":{"observed_at":"2026-08-10T04:30:57.162285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08001","last_updated":"2025-02-06T12:37:15Z","snapshot_observed_at":"2026-08-04T13:24:32.760498Z","submitted_at":"2024-10-10T14:57:51Z","title":"Towards Synergistic, Generalized, and Efficient Dual-System for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08001","snapshot_observed_at":"2026-08-10T04:30:57.167058Z","title":"Towards synergistic, generalized, and efficient dual-system for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.167058Z"},"links":{"cited_paper":"/paper/2410.08001","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:ea8eee196b2924ab50860367c4896895a132231b7f0fcbf3869fc99d0f5d9cb7","observation_id":"ebec5335-ad6c-4ee5-9463-f08b3e5a345d","resolution":{"observed_at":"2026-08-10T04:30:57.167058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.170903Z","title":"Trivla: A triple-system-based unified vision-language-action model with episodic world modeling for general robot control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.170903Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:89dc2a0a3d8660a9a63340d89720a78c9ed4db6236187960133e48e05a2afee0","observation_id":"8f680ca6-4195-4ee6-9e03-f551c3fc6cff","resolution":{"observed_at":"2026-08-10T04:30:57.170903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21432","last_updated":"2025-07-08T15:03:11Z","snapshot_observed_at":"2026-08-10T15:34:18.920235Z","submitted_at":"2025-05-27T17:04:21Z","title":"Hume: Introducing System-2 Thinking in Visual-Language-Action Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21432","snapshot_observed_at":"2026-08-10T04:30:57.174397Z","title":"Hume: Introducing system-2 thinking in visual-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.174397Z"},"links":{"cited_paper":"/paper/2505.21432","citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:d2db898b41a201e08c6c2151b21f60b2061daf5bfad48f398d14d90bf4b0141e","observation_id":"c3761f79-4d71-4820-b142-ab1456f4d407","resolution":{"observed_at":"2026-08-10T04:30:57.174397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.462283Z","title":"Rainbow: Combining improvements in deep reinforce- ment learning,","venue":null,"work_id":"a36753dc-39bd-451f-87ed-d59318d34be0","year":2018},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.178319Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:e5918830471c2aa6e356877af497941db557ee22738047141d03c8c57a619625","observation_id":"436b722d-1bd8-4bef-bd13-9e8f428bcc77","resolution":{"observed_at":"2026-08-10T04:30:57.467006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.183119Z","title":"Offline reinforcement learning with implicit q-learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.183119Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:1a4e4fd019054c2347544083634ce274a8aa17c16b194e6deaaa968a72517fab","observation_id":"3f466f49-7e8c-4f9e-88e8-9f34a4dc8964","resolution":{"observed_at":"2026-08-10T04:30:57.183119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:30:57.440786Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning,","venue":null,"work_id":"f73ed89d-38a3-4877-b043-3ac2a40adf54","year":2023},"citing_paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:30:57.186538Z"},"links":{"citing_paper":"/paper/2608.06434"},"observation_digest":"sha256:fee69a0f9a85f5eb4d8ea2b11e19ba09a7b43d4dcaafcbb06d5584fb58b31c5c","observation_id":"81b1b522-eb53-4a6e-b538-6ecb8ad37dcf","resolution":{"observed_at":"2026-08-10T04:30:57.447073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06434","last_updated":"2026-08-06T06:32:27Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-10T20:09:57.261280Z","submitted_at":"2026-08-06T06:32:27Z","title":"Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2608.06434."}