{"as_of":"2026-08-11T16:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af9e48a80fbee1228fde2e27eedc0f0af4c44354dcb95c09d0d8434b141e73eb","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:35:34.228782Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07596/citation-record","integrity":"/paper/2608.07596/integrity","json":"/paper/2608.07596/citation-record.json","paper":"/paper/2608.07596"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.668202Z","title":"Robotics: Science and Systems, (RSS) , year=","venue":null,"work_id":"51f89435-1013-4b79-a6f0-112566a4ec26","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.909109Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:fafbf9ffeee507f85ba984550506c110ca1aec58464f7c85c5afc41c5ac03324","observation_id":"4b466f73-5780-47a7-9d9d-de629dc6eb3a","resolution":{"observed_at":"2026-08-11T00:35:35.677833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.638455Z","title":"Conference on Robot Learning, (CoRL) , pages=","venue":null,"work_id":"0c99e121-005c-4357-9bc8-72cba25f7e09","year":2023},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.916077Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:9a6deaa787dd9cb9772acbe6ed26376a6230110ddf837d81b6db59c5e0f46a9f","observation_id":"747b62ac-016d-4f60-ae68-4eb035017161","resolution":{"observed_at":"2026-08-11T00:35:35.645715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.618478Z","title":"2024 IEEE International Conference on Robotics and Automation, (ICRA) , pages=","venue":null,"work_id":"f419bd80-d631-4ef7-9ab7-38d6822bc1bf","year":2024},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.921588Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:d17e7c7abba2d4f5f0b48f75aa1834acc5d63df955dcfdd44a7d3115ef4fe805","observation_id":"03d951a4-3e63-4b4c-b79b-42eac8ec0214","resolution":{"observed_at":"2026-08-11T00:35:35.624650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.600711Z","title":"Robotics: Science and Systems, (RSS) , year=","venue":null,"work_id":"e4610df3-e405-48ca-8af3-5368730e0bff","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.926453Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:3dadc7afe8fea020ad27619142dc6fd7cb1b5da7d33d183037fba4bad802283e","observation_id":"f8875d01-5c97-4dbd-beda-4c59d68e95f9","resolution":{"observed_at":"2026-08-11T00:35:35.606242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.579690Z","title":"Robotics: Science and Systems, (RSS) , year=","venue":null,"work_id":"fb138b15-d0b8-48ad-a458-57d566d105b4","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.931814Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:55520b999dcf7d38baa41e6b0242e124b70e87cb611d26a8bc54233dcb855edb","observation_id":"33fb4354-f436-48ff-b975-8337d778a52a","resolution":{"observed_at":"2026-08-11T00:35:35.586224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-11T00:35:33.936905Z","title":"arXiv preprint arXiv:2502.19645 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.936905Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:3ff7961199bc808e1ee5d667c6505e6422a999ffb4ab76865a3459c7b1834a6f","observation_id":"682cfa4d-a884-4f77-a5cf-0565363944cf","resolution":{"observed_at":"2026-08-11T00:35:33.936905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.562230Z","title":"Proceedings of The 8th Conference on Robot Learning, (CoRL) , series=","venue":null,"work_id":"5ddecda5-bd4f-4c05-aecf-0e03ab7c7fc8","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.942229Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:8013a42321d1753a83283d7a75415c6e2ea32ab507a17013848d96b9fdd7b2e0","observation_id":"c8f02491-5e5e-4f75-9447-3836f938b411","resolution":{"observed_at":"2026-08-11T00:35:35.567523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-11T00:35:33.947054Z","title":"arXiv preprint arXiv:2410.24164 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.947054Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:97c148fab206edf18f0339a781b9c8f5edea20b284db913801eb2799a33a7a0b","observation_id":"9a09f445-0443-4831-9461-87aab53256bf","resolution":{"observed_at":"2026-08-11T00:35:33.947054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-11T00:35:33.952595Z","title":"arXiv preprint arXiv:2501.09747 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.952595Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a1f950dade8896701917928a58ffb86c87175ce7900821e6d7300b153f22803d","observation_id":"6532a9a7-af94-47b0-96b7-95d7aafe248a","resolution":{"observed_at":"2026-08-11T00:35:33.952595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-11T00:35:33.957812Z","title":"arXiv preprint arXiv:2501.15830 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.957812Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:7cbfdecde4ac928889ff394b993f8c2a9eac898c5b586978d678b62ec384406b","observation_id":"64f554c9-f6f4-460d-88d6-75c7b1a195c3","resolution":{"observed_at":"2026-08-11T00:35:33.957812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-11T00:35:33.962861Z","title":"arXiv preprint arXiv:2503.14734 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.962861Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c733d850dec583744f46f0c2a2a37fae7ee7a370b2865d3d6484c7c7391e00cd","observation_id":"c9a4b720-77e8-4eef-9b56-4721c48a727c","resolution":{"observed_at":"2026-08-11T00:35:33.962861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19854","last_updated":"2025-04-28T14:47:34Z","snapshot_observed_at":"2026-08-04T19:02:40.317582Z","submitted_at":"2025-04-28T14:47:34Z","title":"NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19854","snapshot_observed_at":"2026-08-11T00:35:33.967894Z","title":"arXiv preprint arXiv:2504.19854 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.967894Z"},"links":{"cited_paper":"/paper/2504.19854","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:45eae83ecf0ef4975a81b651cf7a77f25f0c0d7d93f5587b61863ea2e9ad167d","observation_id":"494832c3-524e-4d9e-897e-2a9695183653","resolution":{"observed_at":"2026-08-11T00:35:33.967894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03912","last_updated":"2025-05-06T18:35:07Z","snapshot_observed_at":"2026-08-07T15:49:25.272514Z","submitted_at":"2025-05-06T18:35:07Z","title":"OpenHelix: A Short Survey, Empirical Analysis, and Open-Source Dual-System VLA Model for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03912","snapshot_observed_at":"2026-08-11T00:35:33.972992Z","title":"arXiv preprint arXiv:2505.03912 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.972992Z"},"links":{"cited_paper":"/paper/2505.03912","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a80f03b63dd1ea8d80d682ad779e02b9d080c3c3378371b9eee0d22771a53b59","observation_id":"9b930aff-6958-4fd1-a881-6e94f5721b07","resolution":{"observed_at":"2026-08-11T00:35:33.972992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.545676Z","title":null,"venue":null,"work_id":"f3f3c421-57c1-481b-b3bd-a532dfc1b2b8","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.977846Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:cdd840809df966cbd1f228223d0c9aad64e967e2d049d12f78a041bdf83da76c","observation_id":"812d97d4-c376-4aca-905e-7c7355cd097e","resolution":{"observed_at":"2026-08-11T00:35:35.550944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-11T00:35:33.982248Z","title":"arXiv preprint arXiv:2505.06111 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.982248Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:74f663952249774cd2386a2de6b456f0201cac3a75aba94db913047c055160b4","observation_id":"452b9d52-ddb7-4c42-adb0-721ef0b315f2","resolution":{"observed_at":"2026-08-11T00:35:33.982248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19850","last_updated":"2025-06-24T17:59:57Z","snapshot_observed_at":"2026-08-06T22:59:06.087089Z","submitted_at":"2025-06-24T17:59:57Z","title":"Unified Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.19850","snapshot_observed_at":"2026-08-11T00:35:33.987020Z","title":"arXiv preprint arXiv:2506.19850 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.987020Z"},"links":{"cited_paper":"/paper/2506.19850","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:5690101d88c442579df7ff5b4a7e20ae9d887e8ce24b384e07fa23c8de99c261","observation_id":"ae01dba0-592c-4607-8fed-b77e1323147c","resolution":{"observed_at":"2026-08-11T00:35:33.987020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-11T00:35:33.991732Z","title":"arXiv preprint arXiv:2506.01844 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.991732Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:0c20a44413947bcb719d39786a1ff35445ddba341b38ad716dbd29afc67af7e9","observation_id":"d898cd00-4121-4ffc-80fb-de129440c20f","resolution":{"observed_at":"2026-08-11T00:35:33.991732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.527116Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"9de5c059-a557-4115-a460-a89d573aa6a3","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.998600Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:fc94e25ed0e36a02df7fe11cf8ceef8bfa9b582fc3168e1a933985cfe83d9882","observation_id":"654f8063-a1f0-45f8-867a-e2fa531093e4","resolution":{"observed_at":"2026-08-11T00:35:35.533311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-10T07:22:51.573401Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-11T00:35:34.003076Z","title":"arXiv preprint arXiv:2506.21539 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.003076Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:9099125a0a2b487ada8561684f58235bd3146ebe5b6367ebbe831921db658fd1","observation_id":"58dde0c7-43be-4497-8470-8740a13758ee","resolution":{"observed_at":"2026-08-11T00:35:34.003076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.506017Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"08fdf374-4443-4fe4-a6d8-a566ac3154f4","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.007922Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:7e4cd0f6651fe98406c5cc66670cd62fd82b6b3243fd7c2ce9632ddb10451ede","observation_id":"6d2a7c34-7c01-4238-8105-634bc36b7a22","resolution":{"observed_at":"2026-08-11T00:35:35.511925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.485676Z","title":"2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages=","venue":null,"work_id":"8b629f65-ed5c-406b-85f9-56a89a855364","year":2025},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.012722Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:9216cd01b1c40e9c42cd1154fe98b9e8a117153de814156e4b6716c58d40ee8c","observation_id":"384e4837-7ed7-4e83-8571-a31b10a9ed7e","resolution":{"observed_at":"2026-08-11T00:35:35.492443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.464261Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"de7442f2-deda-4b1d-8825-b69836ddb320","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.017906Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:ba7c1eeb35a2aead29d69148b30995a69393e7a49a82269b71631aecb73d06c4","observation_id":"b285ceb2-a2e7-4cb1-b587-c1529e08402c","resolution":{"observed_at":"2026-08-11T00:35:35.470050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07917","last_updated":"2025-09-18T12:21:57Z","snapshot_observed_at":"2026-07-06T22:11:09.342568Z","submitted_at":"2025-08-11T12:32:45Z","title":"MolmoAct: Action Reasoning Models that can Reason in Space","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.07917","snapshot_observed_at":"2026-08-11T00:35:34.022811Z","title":"arXiv preprint arXiv:2508.07917 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.022811Z"},"links":{"cited_paper":"/paper/2508.07917","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:9520401355b0206f2bc1021862618546cdb13a2b2db76d29ebbaab98223c7cb8","observation_id":"0099ce7b-955b-4f4f-ac34-4daec65881ef","resolution":{"observed_at":"2026-08-11T00:35:34.022811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.027764Z","title":"arXiv preprint arXiv:2508.18269 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.027764Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:793cca30fee942f50267f108bd4b2993494fba75588fd3c442a0b59efbbdc6b0","observation_id":"2cffc22e-1892-4ef4-8517-1b3d61f21ce7","resolution":{"observed_at":"2026-08-11T00:35:34.027764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.441432Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference, (CVPR) , pages=","venue":null,"work_id":"ddfb3632-d484-4017-9564-97afde12ef77","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.033050Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:85f0895ec230a72a0f442be09237b94220b9e0b3ebba3e3b84a2fdf8a06a94b5","observation_id":"48fb7e2f-7c58-4469-bf01-4029ad0a5c05","resolution":{"observed_at":"2026-08-11T00:35:35.451036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.423880Z","title":"International Conference on Learning Representations, (ICLR) , volume=","venue":null,"work_id":"acb8d8f2-3a3a-4794-8d6d-965b0197621a","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.039391Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:638fbd1d2eb23acc57712528a78b5abe9e3b971e722f63c6bffec1a44ffda19a","observation_id":"0eb855cc-071d-4774-9775-40274226c0c7","resolution":{"observed_at":"2026-08-11T00:35:35.429296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.404513Z","title":null,"venue":null,"work_id":"fd505cb8-0522-4afa-aa5e-7dc9744ba494","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.044424Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:6556ba7bb0809005d8f15b018d04c951863d5ee136e24bf715a592989e643f0e","observation_id":"7613ae2a-4f67-4760-9786-e2821a3b9870","resolution":{"observed_at":"2026-08-11T00:35:35.411988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.049414Z","title":"IEEE Robotics and Automation Letters , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.049414Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:3d695bb3d5af0be64600042e3b63aea866bbb670f1244348c3c092eefa953c9c","observation_id":"8a395ff8-e313-4b32-947d-2c0fb055ba0a","resolution":{"observed_at":"2026-08-11T00:35:34.049414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.376115Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"2b6300d1-7e51-4cb6-982f-50f20dc7e642","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.054221Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:ffa664aca72973dc73c8ebcb449de3ae16e144b362dc828e042eadc2bb40a0f4","observation_id":"b7d25c2e-4a66-453c-adb7-4f04e14f708f","resolution":{"observed_at":"2026-08-11T00:35:35.381114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-11T00:35:34.059112Z","title":"arXiv preprint arXiv:2412.15115 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.059112Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:bc41bf0bde4a8eff9603a5a370ad3f21f174859fa94c838f503f96967d7c6b5d","observation_id":"7cdc859b-2167-4d83-8b10-50d53a5c46b6","resolution":{"observed_at":"2026-08-11T00:35:34.059112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.358467Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"2e4bbed5-5405-4a1e-be96-bce8fe9f730e","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.064174Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b211dd9d157209ca07e8c39bc971e8bdb76f4b8bb0bee711cabea888f099b8cf","observation_id":"89a540b9-7a3b-4112-a607-e3c8ff3fa0a6","resolution":{"observed_at":"2026-08-11T00:35:35.365102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14795","last_updated":"2022-03-15T22:37:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-30T17:53:34Z","title":"Perceiver IO: A General Architecture for Structured Inputs & Outputs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14795","snapshot_observed_at":"2026-08-11T00:35:34.068707Z","title":"arXiv preprint arXiv:2107.14795 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.068707Z"},"links":{"cited_paper":"/paper/2107.14795","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a1a50001cc9b7e052100b96fb7459b02273ca346314b05680a9b1dfa6fb0e3df","observation_id":"1a82e1ca-8c67-46aa-97d6-51cdc5de47c8","resolution":{"observed_at":"2026-08-11T00:35:34.068707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.341548Z","title":"International Conference on Learning Representations, (ICLR) , year=","venue":null,"work_id":"b76337cf-0dfd-44b0-bbb0-13828b0f2013","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.073459Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:cd219e4f90283880681ed3550544381ccf0e7419dc48892b12156505fad416c4","observation_id":"ff8aabc9-3ec9-4aec-8245-d514c0ae8118","resolution":{"observed_at":"2026-08-11T00:35:35.347349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.323145Z","title":"The International Journal of Robotics Research , volume=","venue":null,"work_id":"2e9cdfe0-2446-4147-a287-086e415c9855","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.078271Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:f20d111cedd1cbd1edcb23f5050366130f8b1c322a4e5189db161c42a9e42cb5","observation_id":"6a200344-e35f-4058-a551-56d924274c46","resolution":{"observed_at":"2026-08-11T00:35:35.328884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.304719Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"48a3f2ff-8e3a-4167-a894-b0df173e133b","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.082895Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:1f76deb0d19f37dd241d70bc46f760fbe0338b30598a7841995454abcc201bde","observation_id":"f9cec340-7ed8-4bef-bc5f-6eff2ae5d98f","resolution":{"observed_at":"2026-08-11T00:35:35.311077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.286084Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"ccd859ba-60ba-4719-9129-72bf10bdc1c0","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.087989Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:62138c35a1edb1460db2ea5667f391ee914c00d6f9eea083ccbbcfdfbc540a86","observation_id":"7cfbe172-b2dc-4605-87ac-09ce8aa0f657","resolution":{"observed_at":"2026-08-11T00:35:35.291097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.268397Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"9deb3f44-5f28-49bd-8636-412c80084b91","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.092469Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:ba39b62dee7815a00442c956380906cc434b54d546a747292de66bb74e3cae76","observation_id":"09ce0788-796c-4457-a34c-1e5e412b333b","resolution":{"observed_at":"2026-08-11T00:35:35.274202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.248595Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"df4cb526-c9a5-4d43-bf67-76a978da88f0","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.097210Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:786318c41a03b7cf19d356f61e04f5d5b53a8b8ed6d010b7ddf0911e39a350a2","observation_id":"accb4a2c-31ac-4275-b69f-ceb837a0537d","resolution":{"observed_at":"2026-08-11T00:35:35.255054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.231164Z","title":"Transactions on Machine Learning Research, (TMLR) , year=","venue":null,"work_id":"b8604c7d-7000-4b89-9ade-03c22338b717","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.101372Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:725107f3c9a6125cfb1fce1372c9465f2623ae55b22df377f556936b4b920f4f","observation_id":"ae35bda9-6f7c-4c0a-8b31-db7a4ddb2aab","resolution":{"observed_at":"2026-08-11T00:35:35.236505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.213308Z","title":"Proceedings of the 40th International Conference on Machine Learning, (ICML) , year=","venue":null,"work_id":"a860a4af-8a32-4914-88c4-cbe1944ac0a0","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.105791Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:611f0fc289f038cc1b930f9d7f1d8f4896018eb34d76bb09e67f64e2a393fa18","observation_id":"1f2bfa0d-cc45-40c2-8f8a-08c900ce3224","resolution":{"observed_at":"2026-08-11T00:35:35.219144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.194197Z","title":"Proceedings of the 40th International Conference on Machine Learning, (ICML) , year=","venue":null,"work_id":"8d1b9c7e-1621-49eb-85ac-f69069087391","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.110372Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:85f92587e7eea35aa2a5304cfb561f823aa76605cf8ce046f6aad46a908fb11b","observation_id":"77a90368-18f8-4b58-bbaf-d3662cd51880","resolution":{"observed_at":"2026-08-11T00:35:35.201589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.177955Z","title":"International Conference on Learning Representations, (ICLR) , year=","venue":null,"work_id":"5277d42b-dd3f-4f9e-b23c-45f1c109cf77","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.115440Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:be83966f6a6feb178e5ed034a3cef9a5026fd824f444d35bf4840701149cf2f5","observation_id":"429b474f-dc5b-4e92-8bff-bedf8647c035","resolution":{"observed_at":"2026-08-11T00:35:35.182799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T00:35:34.120708Z","title":"arXiv preprint arXiv:2307.09288 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.120708Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:31d2682c94d94b11a009b5f721f7acc884265cc18771bdb6eedc1f1c77a34199","observation_id":"cad5fe36-c811-4c2c-867a-395178ee963b","resolution":{"observed_at":"2026-08-11T00:35:34.120708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.161606Z","title":null,"venue":null,"work_id":"617dd3b7-2cdb-40f7-825a-89d7aaa02234","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.125755Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:8c20c4c653abfccfaba4fd9312d7ad22d4889701b62b701abea5ddc989412d45","observation_id":"c28e4040-05d6-4f7c-9f64-4fc67c88bbaf","resolution":{"observed_at":"2026-08-11T00:35:35.167202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.15538","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.543351Z","title":"arXiv preprint arXiv:2408.15538 , year=","venue":null,"work_id":"dd5baca6-3fb3-4869-be50-7430f74b9bf6","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.130307Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:dabde5968d468b55135edc4b0f377297c5a09d2522620f21e2c746739ece148a","observation_id":"daf04920-6a90-4785-b118-9723326c2209","resolution":{"observed_at":"2026-08-11T00:35:34.553749Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.144436Z","title":"Proceedings of the Forty-third International Conference on Machine Learning, (ICML) , year =","venue":null,"work_id":"6238396e-d1cb-4565-aa86-f32109d9ad9e","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.134994Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b9d2c5e560c7adc4d7590f0c799de8bf5448a7af68b82c7023dd79bcaa8193b3","observation_id":"3f68d9cb-5f10-437e-985d-86b12305f62a","resolution":{"observed_at":"2026-08-11T00:35:35.149558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13403","last_updated":"2026-05-13T11:58:02Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T11:58:02Z","title":"RotVLA: Rotational Latent Action for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2605.13403","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.13403","snapshot_observed_at":"2026-08-11T00:35:34.408236Z","title":"RotVLA: Rotational Latent Action for Vision-Language-Action Model","venue":"cs.RO","work_id":"0335866b-98ca-4fb9-ad9e-aa07fc7798e6","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.140119Z"},"links":{"cited_paper":"/paper/2605.13403","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:8bc77a0aee049c2232a49fa4bda8adc7d5d1858286c58012d204729c94b2c332","observation_id":"98cb8c74-4c67-491b-8e15-81d524aee35f","resolution":{"observed_at":"2026-08-11T00:35:34.413642Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13382","last_updated":"2026-05-13T11:37:51Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T11:37:51Z","title":"BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning","version":1},"cited_work":{"arxiv_id":"2605.13382","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.13382","snapshot_observed_at":"2026-08-11T00:35:34.385895Z","title":"BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning","venue":"cs.RO","work_id":"eabc7685-2c63-4b51-b7b4-922a95399856","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.145103Z"},"links":{"cited_paper":"/paper/2605.13382","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b503ff60cda700c1b9cd58e3a278c2ccaa4fabcbd793ce52e272349bd1f47ef5","observation_id":"0b052921-fc1e-4c06-b8b6-70d3bb9ddfe9","resolution":{"observed_at":"2026-08-11T00:35:34.391260Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.124741Z","title":"2026 , eprint=","venue":null,"work_id":"6967c4e8-42a8-41ec-95a8-d6127db64953","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.149782Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b869a463fc6961b45521f095d7b791eb08205bef1c2118ce2a672af345d0673d","observation_id":"2370e3a8-2ad4-4b98-ac6a-1dfe439519f2","resolution":{"observed_at":"2026-08-11T00:35:35.131789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.17517","last_updated":"2026-05-17T16:02:05Z","snapshot_observed_at":"2026-07-06T23:28:30.942078Z","submitted_at":"2026-05-17T16:02:05Z","title":"AffordVLA: Injecting Affordance Representations into Vision-Language-Action Models via Implicit Feature Alignment","version":1},"cited_work":{"arxiv_id":"2605.17517","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.17517","snapshot_observed_at":"2026-08-11T00:35:34.361224Z","title":"AffordVLA: Injecting Affordance Representations into Vision-Language-Action Models via Implicit Feature Alignment","venue":"cs.RO","work_id":"a1be23e3-54ef-449e-8f33-88a9e7677985","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.154516Z"},"links":{"cited_paper":"/paper/2605.17517","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:05c687cebc0efb74e0856e36e62cc82dc108652cf24f60a3eb7b2585bd39982d","observation_id":"26ed6c4c-190f-40b2-acc4-f190ccbacca1","resolution":{"observed_at":"2026-08-11T00:35:34.368582Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18719","snapshot_observed_at":"2026-08-11T00:35:34.159303Z","title":"arXiv preprint arXiv:2505.18719 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.159303Z"},"links":{"cited_paper":"/paper/2505.18719","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:adde21872704dbcfd37eeb256c592a9dba999ed612d77dc177af7db779187038","observation_id":"e1a778d8-91c5-41fb-b680-01ea895e6215","resolution":{"observed_at":"2026-08-11T00:35:34.159303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09674","snapshot_observed_at":"2026-08-11T00:35:34.164448Z","title":"arXiv preprint arXiv:2509.09674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.164448Z"},"links":{"cited_paper":"/paper/2509.09674","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:50246dd91473197bc15008ff73fd027ba18cebc909bdf8da2a249b55d19d25a0","observation_id":"fc142794-6e93-4634-8808-0e580b22ddf3","resolution":{"observed_at":"2026-08-11T00:35:34.164448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17016","snapshot_observed_at":"2026-08-11T00:35:34.169769Z","title":"arXiv preprint arXiv:2505.17016 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.169769Z"},"links":{"cited_paper":"/paper/2505.17016","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:e036a2bc60e950dd723f06131dd9b1e863f8ba9055462ba8b3b0bd60cbba4484","observation_id":"60bdbcd6-3d96-46a7-8f96-07508a834730","resolution":{"observed_at":"2026-08-11T00:35:34.169769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02881","last_updated":"2026-05-08T04:21:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T17:51:21Z","title":"MolmoAct2: Action Reasoning Models for Real-world Deployment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02881","snapshot_observed_at":"2026-08-11T00:35:34.174630Z","title":"arXiv preprint arXiv:2605.02881 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.174630Z"},"links":{"cited_paper":"/paper/2605.02881","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:ef659a4fd48145e782cd799257ff457d56479a0adbebbb24a0a7e0211097fb68","observation_id":"387c7aba-4810-43e6-9d69-c54dc25d2456","resolution":{"observed_at":"2026-08-11T00:35:34.174630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.104243Z","title":"and others , journal=","venue":null,"work_id":"df9aa3b8-a907-4055-9bcc-994d7584c0cc","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.179643Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:3402aecc5ae73fc3dc62c49df94388a3b2a8f77bb39efd22c7e5fcd254d40589","observation_id":"3733861e-2b9e-4789-b9c0-7e502471ae80","resolution":{"observed_at":"2026-08-11T00:35:35.111802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04996","last_updated":"2025-09-05T10:43:12Z","snapshot_observed_at":"2026-08-05T05:48:44.865688Z","submitted_at":"2025-09-05T10:43:12Z","title":"FLOWER: Democratizing Generalist Robot Policies with Efficient Vision-Language-Action Flow Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04996","snapshot_observed_at":"2026-08-11T00:35:34.184325Z","title":"arXiv preprint arXiv:2509.04996 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.184325Z"},"links":{"cited_paper":"/paper/2509.04996","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:935888e17404ef635d1f55322b6f15b4dd9f80936c22658a1edfbeed57b8b0ef","observation_id":"fc4847fe-5c01-4735-a15d-1d37ef460d09","resolution":{"observed_at":"2026-08-11T00:35:34.184325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.085504Z","title":"2026 , eprint=","venue":null,"work_id":"86aa6078-a952-4b2f-999e-95cc3ffb1916","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.189249Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a0e38d961312634f767671e5d972e1cb0c52696ec5c1172715ebe83d88bfbd7a","observation_id":"f067a94a-9ab2-4706-ad45-d746a1e180ba","resolution":{"observed_at":"2026-08-11T00:35:35.090873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.26432","last_updated":"2026-06-24T22:44:29Z","snapshot_observed_at":"2026-08-06T20:28:46.367750Z","submitted_at":"2026-06-24T22:44:29Z","title":"Embedding Foundation Model Predictions in Discrete-Choice Models with Structural Guarantees","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.26432","snapshot_observed_at":"2026-08-11T00:35:34.194998Z","title":"arXiv preprint arXiv:2606.26432 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.194998Z"},"links":{"cited_paper":"/paper/2606.26432","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c01932de0c889ef66da3100038ba99941202e7c76025b9b202748b0d5c9ed169","observation_id":"311f268c-441b-4818-a525-169c84b1f508","resolution":{"observed_at":"2026-08-11T00:35:34.194998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.063877Z","title":"ArXiv , year=","venue":null,"work_id":"9a7f4979-af5e-4159-ae4f-1588ebaa8e2e","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.199800Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:93fe73d320feed2f366121108ab545c8b3c19e85b187bc162763e23e8307fe7d","observation_id":"f47b5549-1a4c-422f-b287-f8be58816944","resolution":{"observed_at":"2026-08-11T00:35:35.071444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.043829Z","title":"European Conference on Computer Vision, (ECCV) , pages =","venue":null,"work_id":"d2a798e2-f06f-448e-b7de-ce152c6bcf3c","year":2022},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.204521Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:7e86f810046b3b981c2c145869f82d06b5eac37eccbe5fd73537efa244ea5dce","observation_id":"a3d555db-bf36-4c4d-911b-35f6e5555317","resolution":{"observed_at":"2026-08-11T00:35:35.049969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.022310Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"fb32ca84-5766-4135-b6c1-b34a2a3cd977","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.209515Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:d519cbd537f932980310ccccae4b97ae15e3ac914a7a77e18393ee96b69089a5","observation_id":"8a6f43bd-0148-4b67-86e0-ad93073c771e","resolution":{"observed_at":"2026-08-11T00:35:35.029580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.002154Z","title":"ArXiv , year=","venue":null,"work_id":"9a26ee28-a16a-4919-962a-787b75e545c1","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.215143Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a7593e256cbb143dc0a14e555c4ca716095b9ec6bd3ac2c8ed6a51cbbe02d337","observation_id":"c8070d3d-f600-4770-8ad6-794e0c8b8b50","resolution":{"observed_at":"2026-08-11T00:35:35.008183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.981644Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"bafbfd7e-3823-4c8c-934c-1b6072ac40ef","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.219806Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:377f3ec426fde2c5b0cc3810fa205739b7a3629ec7481138caea520fd1569e1a","observation_id":"759e1ce8-a181-4f4a-b0a8-ea1a950920a5","resolution":{"observed_at":"2026-08-11T00:35:34.987118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.965051Z","title":"Proceedings of the European Conference on Computer Vision , pages =","venue":null,"work_id":"ab971ad2-d1fa-40cc-bd0b-f16dc27300c8","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.224308Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:190e76501542878938f862544912e0bfcad76d2a233b00e43696fe1bc2e7b8cb","observation_id":"76fbabbe-c2f9-43af-b4fe-2fbb9aebfa29","resolution":{"observed_at":"2026-08-11T00:35:34.970101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.946140Z","title":"2026 , eprint =","venue":null,"work_id":"4044c99d-4fa0-47af-96de-7b3b6af7236f","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.228782Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c30ae580b6ca4f8d7cf52b358f0dfdcd08040cd4ce345837ace15aa7f8301e37","observation_id":"6fe099af-dc77-4460-835d-f46587f6cb41","resolution":{"observed_at":"2026-08-11T00:35:34.952900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-11T16:13:47.654964Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2608.07596."}