{"as_of":"2026-08-15T12:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a994a8c295dbccf116a3616cd8345b04c8e22be386930cbd82d87367c6082764","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:32:44.985993Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08904/citation-record","integrity":"/paper/2608.08904/integrity","json":"/paper/2608.08904/citation-record.json","paper":"/paper/2608.08904"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.08636","last_updated":"2024-04-12T17:58:04Z","snapshot_observed_at":"2026-08-13T00:31:07.251379Z","submitted_at":"2024-04-12T17:58:04Z","title":"Probing the 3D Awareness of Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08636","snapshot_observed_at":"2026-08-14T04:32:44.909282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.909282Z"},"links":{"cited_paper":"/paper/2404.08636","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:a5862fad35b030ba8506373c9e7341f8c1f74c2194c07cd5f0c64c0f3e0dd18d","observation_id":"6e75eabd-48d0-43e8-8b18-7f1c5fff0c8f","resolution":{"observed_at":"2026-08-14T04:32:44.909282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-14T04:32:44.913405Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.913405Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:56502d07aefdbae7db50606aa55d7beb85015e91a1e8d44df7cd149e586e041c","observation_id":"de8d0a9d-8e96-4500-8bce-be5c9d96a3a9","resolution":{"observed_at":"2026-08-14T04:32:44.913405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:32:45.328444Z","title":null,"venue":null,"work_id":"053d9835-4e60-45b9-8b2b-f64db08809f4","year":2025},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.917156Z"},"links":{"citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:0ce3fe142568d8d66c3383d0b102128c8370bfac249b581f2ee336334c6ede13","observation_id":"28f13a92-ab94-490a-8e7b-a3f25fd027f5","resolution":{"observed_at":"2026-08-14T04:32:45.331055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-14T04:32:44.920697Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.920697Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:b3bb4c46c14c60f0bcb81d31d51da39ae09df68f6fbcab59e446a70bff99a98b","observation_id":"51a1fff4-58ca-4464-a79d-b2e3f1c05e43","resolution":{"observed_at":"2026-08-14T04:32:44.920697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-14T04:32:44.923942Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.923942Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:7ba6d584de8a51957e18485814a437832e3f7f6469b62e19b37f88ced2e70c7e","observation_id":"a181b322-52df-4293-bcf8-dbf8ea7fd92a","resolution":{"observed_at":"2026-08-14T04:32:44.923942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:32:45.319696Z","title":"Lawrence Erl- baum Associates, 2 edn","venue":null,"work_id":"8d66a1e5-e739-4d9c-95db-c236e3119c52","year":1988},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.939469Z"},"links":{"citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:56e8e25c2fea17851f5dc912a699155c50aab2a6af1577fd8ce1e7c9d8c32403","observation_id":"8208b93f-7d51-417b-a91c-9fafeb2c98ba","resolution":{"observed_at":"2026-08-14T04:32:45.322309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23705","last_updated":"2025-05-29T17:40:09Z","snapshot_observed_at":"2026-08-07T12:37:05.162590Z","submitted_at":"2025-05-29T17:40:09Z","title":"Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize Better","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23705","snapshot_observed_at":"2026-08-14T04:32:44.942639Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.942639Z"},"links":{"cited_paper":"/paper/2505.23705","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:e4c6292a7b3396bcd8e1d51a6cf0374a1f26a3e6422d812ca84cbfb482c7c9fd","observation_id":"39400551-17af-4ba7-9d22-07501ad615d7","resolution":{"observed_at":"2026-08-14T04:32:44.942639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:32:45.311370Z","title":"Transformer Circuits Thread (2021),https: //transformer-circuits.pub/2021/framework/index.html","venue":null,"work_id":"49e537d1-2fd6-4eae-bec9-af1393c146f4","year":2021},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.945701Z"},"links":{"citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:6b676b2d7aa4d90018df86eb9f01f00e2398fd44ad2bedd58b3246e841833148","observation_id":"1a80fa48-5aba-4772-ae57-3b657eb25423","resolution":{"observed_at":"2026-08-14T04:32:45.314255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02881","last_updated":"2026-05-08T04:21:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T17:51:21Z","title":"MolmoAct2: Action Reasoning Models for Real-world Deployment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02881","snapshot_observed_at":"2026-08-14T04:32:44.948419Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.948419Z"},"links":{"cited_paper":"/paper/2605.02881","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:3b716090289d2fe6369e317a6f52faa6b3b60daa2e3e44ca549d14daaaecff2d","observation_id":"fcbce151-4299-4621-86de-814b021eae3d","resolution":{"observed_at":"2026-08-14T04:32:44.948419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-14T00:33:35.030678Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-08-14T04:32:44.951236Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.951236Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:f2284a9058a45a19baa64573730d47b0cada543537e39bfddd22504164986f03","observation_id":"e5afcdb7-fb68-485c-9865-70b5fe39a1d7","resolution":{"observed_at":"2026-08-14T04:32:44.951236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-13T01:11:33.500647Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-14T04:32:44.954186Z","title":"In: Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing (2021),https://arxiv.org/abs/2012.14913 14 A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.954186Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:f23a08b42c9ae3b086481667a34e18095d8e93cba4d563368303052b07267063","observation_id":"4511cab6-af4e-47c6-8798-6de13e483da4","resolution":{"observed_at":"2026-08-14T04:32:44.954186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:32:44.957266Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.957266Z"},"links":{"citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:c833209649cbe5825e295c13910dc77ba3e0e950214a56c729381df6348c8c98","observation_id":"7cad8414-22dd-475d-a530-459462813768","resolution":{"observed_at":"2026-08-14T04:32:44.957266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-15T04:55:15.159462Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-14T04:32:44.959556Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.959556Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:79a646607f1aeb7c4dfd63eb175ecbbf705703e8f9d45fae2071c939b8457618","observation_id":"1658f062-6ef7-46e5-a2ea-8dfe61dcab64","resolution":{"observed_at":"2026-08-14T04:32:44.959556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-14T04:32:44.962378Z","title":"org/abs/2511.10647","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.962378Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:77cf54d265695aefece97c8d3932726a2a06f070cddbdd856c13ecaebcf728cd","observation_id":"c8bd2a04-cf5a-4ff8-8820-69d53c7ac401","resolution":{"observed_at":"2026-08-14T04:32:44.962378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03310","last_updated":"2023-10-14T15:52:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T23:32:26Z","title":"LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03310","snapshot_observed_at":"2026-08-14T04:32:44.964918Z","title":"org/abs/2306.03310","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.964918Z"},"links":{"cited_paper":"/paper/2306.03310","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:5d9accd56301032f60f4f2872145069bd995586bbd216943bc4d3aa736dc48e7","observation_id":"d04c7646-b0cd-4edd-8ddc-5cef1a831275","resolution":{"observed_at":"2026-08-14T04:32:44.964918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:32:45.302754Z","title":"In: Advances in Neural Information Processing Systems (2024),https://arxiv.org/abs/2409","venue":null,"work_id":"f256f5b9-8520-4303-a3dc-877f94f2d26f","year":2024},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.967695Z"},"links":{"citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:bf94164e4f6cdd3eea80554276504f6719e59b5725c799e5b01a1084854f220c","observation_id":"6a713347-9697-4530-a832-2594a70333ec","resolution":{"observed_at":"2026-08-14T04:32:45.305805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05262","last_updated":"2023-01-13T15:16:16Z","snapshot_observed_at":"2026-08-13T01:40:21.606634Z","submitted_at":"2022-02-10T18:59:54Z","title":"Locating and Editing Factual Associations in GPT","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05262","snapshot_observed_at":"2026-08-14T04:32:44.970047Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.970047Z"},"links":{"cited_paper":"/paper/2202.05262","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:64c9a02678a271d6cc7e5b9866ce389671a095d17bb69b55a1867112f263736b","observation_id":"d75fd2e5-4cc8-49ba-93e9-e9b69d67b8f2","resolution":{"observed_at":"2026-08-14T04:32:44.970047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-14T04:32:44.972658Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.972658Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:8d767bc03894ddb2d73448e763d1bcfdd88ce2d34710bd7c5d66b9086cd59eea","observation_id":"8fee45f9-c5ba-449b-a4d7-24ccbbfa5961","resolution":{"observed_at":"2026-08-14T04:32:44.972658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-14T04:32:44.975880Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.975880Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:38ac6379992ccbbe93f4dbbdcbe4566975a57b76dec6fc4def6ff301c3bd92c7","observation_id":"f350fbba-0654-4260-a30c-e636659901c2","resolution":{"observed_at":"2026-08-14T04:32:44.975880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13413","last_updated":"2021-03-24T18:01:17Z","snapshot_observed_at":"2026-08-10T08:54:33.970541Z","submitted_at":"2021-03-24T18:01:17Z","title":"Vision Transformers for Dense Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13413","snapshot_observed_at":"2026-08-14T04:32:44.978587Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.978587Z"},"links":{"cited_paper":"/paper/2103.13413","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:5510a96158a6e3938ff5c2e6d5ebeab5c40cf20e8cf5f9d15adb76f47375490a","observation_id":"850fabfc-b14b-4658-ad72-f3e3ce984c60","resolution":{"observed_at":"2026-08-14T04:32:44.978587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-14T04:32:44.981103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.981103Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:83c92129986857c1f63c840d2f816b9c3d5f8e6798a1df758360f6de7d659644","observation_id":"9f1e0eb2-2afe-482c-8718-3036067ad2df","resolution":{"observed_at":"2026-08-14T04:32:44.981103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.17228","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:32:45.054093Z","title":null,"venue":null,"work_id":"26ba14e4-b960-45b1-a302-d5e7531b6ed9","year":2026},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.983617Z"},"links":{"citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:987cbdc71f90cc4e92d31faf3f82f34e5219409446c49af87fee777e5c31e67a","observation_id":"71004ad8-82fd-4766-8a72-6710f1f3956d","resolution":{"observed_at":"2026-08-14T04:32:45.061989Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:32:45.292547Z","title":"The data are LIBERO frames sam- pled at stride 5 per rollout, resized to 256 pixels, with primary and wrist views","venue":null,"work_id":"36e1bfbf-c3d2-49e1-a120-f6f2bcc93958","year":2025},"citing_paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:44.985993Z"},"links":{"citing_paper":"/paper/2608.08904"},"observation_digest":"sha256:8b81e537d213f068fb184eb429fd657942d50c1bfd693dfda24ac64adbf9c82e","observation_id":"5b108007-62d8-479e-b38c-1b7b450cc849","resolution":{"observed_at":"2026-08-14T04:32:45.297054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08904","last_updated":"2026-08-09T20:31:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T11:14:51.802805Z","submitted_at":"2026-08-09T20:31:52Z","title":"From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Decodability"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2608.08904."}