{"as_of":"2026-08-06T06:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:190e3a7c9e53532a6b8f47c7b5ca023b27b40a6b3c4061848d88cb93bac00661","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T00:38:30.478177Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:44:43.730693Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T05:44:49.248067Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"cited_work":{"arxiv_id":"2607.03693","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.03693","snapshot_observed_at":"2026-08-05T05:44:49.248067Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","venue":"cs.RO","work_id":"a0478d5c-0384-4f8e-8ddc-0c65fa766e56","year":2026},"citing_paper":{"arxiv_id":"2608.03924","last_updated":"2026-08-04T16:56:09Z","snapshot_observed_at":"2026-08-06T05:47:08.650849Z","submitted_at":"2026-08-04T16:56:09Z","title":"ETA: A New Agentic Paradigm for Embodied Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T05:44:43.730693Z"},"links":{"cited_paper":"/paper/2607.03693","citing_paper":"/paper/2608.03924"},"observation_digest":"sha256:8f974f94d5dedd4afeed26f16054edad63314e490d9bb44715e3e6af8113e998","observation_id":"258d6263-c6a7-44d2-b9f4-c89b011b33e2","resolution":{"observed_at":"2026-08-05T05:44:49.306927Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.03693/citation-record","integrity":"/paper/2607.03693/integrity","json":"/paper/2607.03693/citation-record.json","paper":"/paper/2607.03693"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:96b1547262bfc3829bb6a654af565edd383884eb4c948fa8dd6d943cf1028d92","observation_id":"bd5777f8-2089-4c3d-b433-5d6eea5f84b2","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Black, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:c93b2528a71925265ecd91c9abbd332a7d78962bdcad33adc9dfb662de7fef23","observation_id":"d0504cce-23f8-4fe5-84e9-cb0cb98e65c9","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Black, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:aaa8585b51d880c3bdbb9ade123ee951434b5e23c9eb47e4bcfaafd9094b2061","observation_id":"4dd2b8cc-10e0-4ae6-ac85-759492f8f3da","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Bjorck, F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:c64d9d062c5470299553a7ebd6cb31b580a2162e1f416195afa369fc940e6695","observation_id":"cb0d4078-80aa-45a1-a84d-fe845c6befa8","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:0d08e1b9d2c77f55b5b4a795f0d6ed84674c9ea01ef231848c24251a6767c82d","observation_id":"ac5ae490-d3b0-4747-8803-75ff346a5ff5","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Standley, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:972ee0426d4b149ab80e8bb90a44ae66c70da6855e55932e7ff562793d1105bf","observation_id":"8c3f4ac2-a809-4f59-b4ba-d633a07cfa9f","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Brohan, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:30eaaf5cde042db6c8a344beb778ef6494002fa80042289ae1bf5fa1cbd97123","observation_id":"b78bf8b7-1706-4a37-8176-18f9bafea9cd","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Zitkovich, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:993225633866739e4dd22cb3b3d014e7eaf263a2e7a1fb52a146716db343b62e","observation_id":"b6fce0c8-7d7d-455d-a0b6-4484c013f933","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Ghosh, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:79d9531a9b9c2aff4bbe638f8b64585982c5f208027cc09886a235252b01a01e","observation_id":"3adfa51a-125d-4a1a-bb67-40fba2a25ed7","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Shridhar, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:3a1d76128d7a2cd720661f3d1f065ddc251446efe1a45c096aa278310a07cb68","observation_id":"e9a5661f-49f8-42e7-8f95-0b1c7798dded","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Goyal, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:758ade258b9103702a10ce1e12faa38c4d3536f264357a5bc339a48eac377452","observation_id":"479730f7-7a18-4a2e-abe6-2b9a19d97079","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:eb9f19f2296823051780da325e78e1fabb63694365f1bf4a58da74fdbb2cf08c","observation_id":"37bc9c39-ef97-4ae4-b5da-52212baca02d","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:8a7e76e0c00541ce3f2a34cced1b2c574be27798110b7def26b4c73447a1f94f","observation_id":"c0aa2b97-e33e-498b-9f13-58b471c52406","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:6c1af92394045171fc8d40a3579a422998334130c1f671a5a8aa26fda65b693f","observation_id":"da5be9ec-04f0-4a90-847a-3cf5e40bfc76","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Shazeer, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:3f3617df5d79833486a99a8354ec8f2e13af14a1d943fb818c5d8ccd8e37a4e6","observation_id":"de547883-1b22-4fc1-9de1-dc7c08aa8a62","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-07-06T09:33:58.857566Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Lepikhin, H","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:3201d346f539b8eaa72597d1ff661dffe8f9366ec3f0ad241233f6b6f6b6ece1","observation_id":"51d353bb-e721-4461-9f09-aef02dcf1431","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Fedus, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:02a78981b5c8d15b0b2a8f3c1bb86a7aa9be3de524e8bc127f495ea965c925fd","observation_id":"f4e0e983-45d2-46a9-969c-e4f7ac0acdcd","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Raposo, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:18f501c3175bd6dc02d28094b301237269edf3cdd2704a569f58ec42b3bb0d82","observation_id":"ecafe888-16d9-4f72-a537-02cbed1f5f3b","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:6546937f55494c9c0b6b932624085690742f75c1ec73a0784be7157b5f14a811","observation_id":"0797dcf7-7de3-4c30-9c92-57a932bd61b0","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:1d042a843208d5bb4078259d474fdf441e550d6969de2af8cd34ff9d45536f93","observation_id":"498d5b82-aa81-4b49-a59f-eb8d6cec4211","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:7b1ad1a197fdbbb33639ace09de81eab2d0f108332358b5a1ea17ddeab13ac9e","observation_id":"4efe390d-e8ef-450c-9515-8e3d94a55c56","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02523","last_updated":"2024-06-04T17:41:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T17:41:31Z","title":"RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02523","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Nasiriany, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2406.02523","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:b11a8739f764044b1ba5d5401fb7d4e2ee0e8e2334046771cdd7e856f9af777e","observation_id":"cf47e493-e755-4fa0-b049-6e3d39ec42c8","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:0bff4c0ac12455e00a5ec58bbcf522c1e29b0e702ee645ea038c6092091faff8","observation_id":"1f8bb838-ab34-403b-82a4-aedc2ea2aea4","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:47e29cee487fccc30947b767a1064f7226ef9ae08cd57cd667496eb8caa53f05","observation_id":"b3bc8569-567d-4b2a-b020-0ffa6e605e46","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:f5c9ec46213be0909bb000e4b3d50f7b42af0f695a26b1c6ddfb16505e9b4c68","observation_id":"de868d1d-4a9b-4c75-8b34-bfd9e1f0e3d8","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Pertsch, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:5c7fe16afc491d43e0796e114bcbeed92730f10307cf7e2f1590e3f943bcbc26","observation_id":"4937d692-42de-484d-bbff-402ba66ac30b","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"GR00T N1.5: Official libero fine-tuning and evaluation results","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:721b0c45f8d32040e66796ef775049c1a4f0d91c08d6dc7fc5a2b937a5e0cd54","observation_id":"0c5b4d5d-9c74-4eff-8e27-af0255c570d5","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"GR00T N1.7: Official libero fine-tuning and evaluation results","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:a3750f8ad9b3817d440d3dff433aca4bdb6fb68258039d32df33458f34e880ea","observation_id":"306cc477-7dec-4239-87b9-99696ded0c8f","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:d294c5b87e09abd4b36038b9f25501cce34150279c6c4077a540cbf721bcb4f6","observation_id":"a3b11535-983d-44db-8ff0-4e400ba04b5c","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"GR00T N1.5: Official robocasa tabletop fine-tuning and evaluation re- sults","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:396a9fbca390e01212cd95b9b96de257952801ece4602f299d5b2ca718ed3c8d","observation_id":"09eb3a8b-613a-498e-be76-e1b1c5bc089b","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Accessed: 2026-05-16","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:b07b16b2fa8b6494c8a8741e90efa488e46e102bd49ac14e548fbfa50adc0e1c","observation_id":"f7ab8c97-76c0-4114-b789-6c6d3deff5e4","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"GR00T N1.6: Official robocasa gr1 tabletop tasks evaluation results","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:073696fa9a7c82ad45d1af44d05dc3f577da0f459ba9ae7cc58953b3eb185015","observation_id":"47ca666e-3f78-4460-aa18-b61bf99281d2","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T00:38:30.478177Z","title":"Accessed: 2026-05-16","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T00:38:30.478177Z"},"links":{"citing_paper":"/paper/2607.03693"},"observation_digest":"sha256:f7eab9895a7ea9cb919626306e1da58358bd526dde4b846780bb881fe19c958b","observation_id":"0cdbc674-9be6-4625-84ed-3f43e4bd2ffa","resolution":{"observed_at":"2026-07-12T00:38:30.478177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03693","last_updated":"2026-07-04T03:58:09Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-12T00:38:29.934075Z","submitted_at":"2026-07-04T03:58:09Z","title":"CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2607.03693."}