{"as_of":"2026-08-06T01:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39b1dc8971b3e09454c4067be78681601ed195b8377f76b91950e40340e973ce","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:53:56.269363Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T00:25:50.472392Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05525","snapshot_observed_at":"2026-07-31T00:25:50.472392Z","title":"CrowdVLA: Embodied vision-language- action agents for context-aware crowd simulation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25140","last_updated":"2026-07-27T23:22:17Z","snapshot_observed_at":"2026-08-04T17:42:11.884306Z","submitted_at":"2026-07-27T23:22:17Z","title":"How Affect Propagates among LLM Agents: Emergent Emotional Contagion in Crowd Simulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-31T00:25:50.472392Z"},"links":{"cited_paper":"/paper/2604.05525","citing_paper":"/paper/2607.25140"},"observation_digest":"sha256:cac322511d0fc291904c279a0a3a4789f0ae296545475910725064a609d52580","observation_id":"5919e810-075f-4faf-8fa4-4dfe790f7e52","resolution":{"observed_at":"2026-07-31T00:25:50.472392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.05525/citation-record","integrity":"/paper/2604.05525/integrity","json":"/paper/2604.05525/citation-record.json","paper":"/paper/2604.05525"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:0a499ab1d1a5f02334a4c5f2b2b3d41f1010e9363c6a8f8a4483f8ad08c85f0f","observation_id":"8b0758d0-77d9-4530-90e8-ac90a88f73f2","resolution":{"observed_at":"2026-05-10T23:45:52.148362Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peng Chen, Pi Bu, Yingyao Wang, Xinyi Wang, Ziming Wang, Jie Guo, Yingxiu Zhao, Qi Zhu, Jun Song, Siran Yang, et al","venue":null,"work_id":"028d73df-eb46-4998-b7bf-1d87f873111b","year":2023},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:19632deeb6f972a8ffa7ec29bf96353ee2c4ef225261e24b143fedd7fdc2bd0e","observation_id":"1bf56a5a-cba9-4fef-b2a1-a1b1477f5677","resolution":{"observed_at":"2026-05-16T13:12:55.261995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.09527","doi":"10.48550/arxiv.2503.09527","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Combatvla: An efficient vision-language-action model for combat tasks in 3d action role-playing games.arXiv preprint arXiv:2503.09527, 2025a","venue":null,"work_id":"2e1a31ec-35dd-4448-aace-64849c632344","year":2025},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:853d84e17fc075392b860cc1bf8863094580024c6f9eb0d081bfd500c0986587","observation_id":"9420eae4-948e-4aa0-8a6e-01b82769fb84","resolution":{"observed_at":"2026-05-10T23:45:52.072465Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13243","last_updated":"2026-04-17T23:12:55Z","snapshot_observed_at":"2026-08-04T01:21:26.466156Z","submitted_at":"2024-02-20T18:55:09Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","version":2},"cited_work":{"arxiv_id":"2402.13243","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.13243","snapshot_observed_at":"2026-07-10T08:36:59.845914Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","venue":"cs.CV","work_id":"e7670f83-e1e1-41e7-86eb-39477a3a10b2","year":2024},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2402.13243","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:71c153c454ad732b18deb9921cb9fab42109a0d52fe7a9732d874982cab17ae9","observation_id":"8e9868df-4e1e-4bbc-8d25-93d2f8af14a0","resolution":{"observed_at":"2026-05-10T23:45:52.097393Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the 2009 ACM SIGGRAPH/Eurographics Symposium on Computer Animation","venue":null,"work_id":"cd989c41-cf30-42a5-951d-bab83703564d","year":2009},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:9084369e78dcd57de6ec81dcc2f0624c3e08a591f4f99facd88ed0ce29f44b1c","observation_id":"133ce87f-d7f4-45a8-9116-e16f998d9133","resolution":{"observed_at":"2026-05-16T13:12:55.272271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the 2011 ACM SIGGRAPH/Eurographics symposium on computer animation","venue":null,"work_id":"6d60127e-bf02-4f70-b8d1-9b28bc13a51e","year":2011},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:d9a73b4e6ba2df03f160fa6c2a2a2a2082eda613968017261b86a230579a6eee","observation_id":"78636f50-b63e-47fd-90d9-1f63cc94990b","resolution":{"observed_at":"2026-05-16T13:12:55.264908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physical review E51, 5 (1995)","venue":null,"work_id":"543d75b0-3719-4531-b605-3830e7ea9671","year":1995},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:7e52c16c02957a832167de559efc2b680a871e3855e5e9743cd16b78591bb319","observation_id":"753d8ad8-2021-441b-9487-eed1130b110c","resolution":{"observed_at":"2026-05-16T13:12:55.270036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2a3663df-d336-45ad-8ceb-87ed1a7cd3a9","year":2022},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:0f4fe840215ee6774c4edb834792fd66df12af42b40fc1c5779d4bdca9fdda21","observation_id":"f9f526bd-ae45-494f-8404-7959e8bda668","resolution":{"observed_at":"2026-05-16T13:12:55.267530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xuebo Ji, Zherong Pan, Xifeng Gao, and Jia Pan","venue":null,"work_id":"e752faf5-4c51-4058-b331-2fc54ee9fe1e","year":2021},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:6784e6ee8b18efc382faf77cc3d358a14ac52908da7b5a22c1c5c8ad5ee933dd","observation_id":"0ab72f39-2341-413e-84a7-bc66e9061ba5","resolution":{"observed_at":"2026-05-16T13:12:55.259618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InACM SIGGRAPH 2024 Conference Papers","venue":null,"work_id":"5b909ed3-04c4-4b95-9cec-3bf0c2502462","year":2024},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:ebb730b4e9d9acac20cd17b6bcd7f4978dbe8cb4c80244b862920d7d7a77a715","observation_id":"09fa6925-eb75-4f87-89fd-3257ac945c6b","resolution":{"observed_at":"2026-05-16T13:12:55.226490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mubbasir Kapadia, Alejandro Beacco, Francisco Garcia, Vivek Reddy, Nuria Pelechano, and Norman I Badler","venue":null,"work_id":"3a38e9b1-21da-4a4f-9e10-678c5507f2e0","year":2010},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:ae2627997556b7d705e67f47789a65bccc4cad6473e53f4a6ed368564539df05","observation_id":"f908a077-21db-4516-a107-6ea65820188c","resolution":{"observed_at":"2026-05-16T13:12:55.251075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":"2502.19645","doi":"10.48550/arxiv.2502.19645","metadata_source":"pith","pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","venue":"cs.RO","work_id":"04f46bb3-4346-47e8-bf09-c75d91f96e87","year":2025},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:3ec0ca9cc8384e4db78faf7c4df42f536cbb3c78b744af358f05d45abe8c6c55","observation_id":"ddcac3d9-d801-47c3-90c3-314532b7988a","resolution":{"observed_at":"2026-05-11T04:35:33.294794Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:12f23a65058c84d4c36f2e6c59b567152f34ff45f86c2cc3e0ecba6fa3216617","observation_id":"82d1df69-a857-4da9-9a3d-3a8387320ad2","resolution":{"observed_at":"2026-05-10T23:45:52.042498Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the 2007 ACM SIGGRAPH/Eurographics symposium on Computer animation","venue":null,"work_id":"6e249cc0-5f93-4135-b643-30ebf987baa5","year":2007},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:ce411084fb7d47d8567986f8473e4c9d072eb246fc20c7a149c7dc41c1f77b1a","observation_id":"e7c655bf-f00a-45ba-9401-7a06f4526cc2","resolution":{"observed_at":"2026-05-16T13:12:55.248223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01941","last_updated":"2025-04-09T12:01:43Z","snapshot_observed_at":"2026-07-06T21:03:11.554376Z","submitted_at":"2025-04-02T17:47:23Z","title":"End-to-End Driving with Online Trajectory Evaluation via BEV World Model","version":2},"cited_work":{"arxiv_id":"2504.01941","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.01941","snapshot_observed_at":"2026-07-04T19:30:07.201101Z","title":"turn left","venue":null,"work_id":"96ea8513-8adc-42ef-85bf-d2686aa7f0ab","year":2025},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2504.01941","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:361ec855c8cd2131cfae62d1bce01c89176e27314e3a17e7fe4e0a86bcbe7045","observation_id":"1f5f9000-ea78-43b2-b4fc-55436cda8c1b","resolution":{"observed_at":"2026-05-10T23:45:52.131692Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":"2406.06978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-07-10T08:36:59.824360Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","venue":"cs.CV","work_id":"c1e2622d-92db-4a96-aa17-8ef832270ed1","year":2024},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:e2a77719b45869a7dcaa626c39c249c0735101896f1596e93fb8ec473631040f","observation_id":"77444caf-1518-46da-a822-559696a857fe","resolution":{"observed_at":"2026-05-13T23:13:55.802367Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Andreas Panayiotou, Theodoros Kyriakou, Marilena Lemonari, Yiorgos Chrysanthou, and Panayiotis Charalambous","venue":null,"work_id":"510d841c-823d-42e2-a7dc-fd040bf318d2","year":2010},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:d865ca440630c26b8e91de4b4c8f25855f5e3bce8ce06551886ea52c27ab967d","observation_id":"2f7d31c6-b764-4571-83dd-dd4b43937f37","resolution":{"observed_at":"2026-05-16T13:12:55.256608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InACM SIGGRAPH 2022 conference proceedings","venue":null,"work_id":"22777c80-9921-430e-b279-0935c73d8bd5","year":2022},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:2433faaaef441e0b5e4c3e4c6c6c2bcf223f3cd55c81a4d5895a6c0acc478f4f","observation_id":"0df1422b-7454-41ed-91f9-82b730160382","resolution":{"observed_at":"2026-05-16T13:12:55.242176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alexandre Robicquet, Amir Sadeghian, Alexandre Alahi, and Silvio Savarese","venue":null,"work_id":"4cd5909f-5d91-41d9-9d2e-dcd9e92e894a","year":2010},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:c90326170ecab9868a4032148ddfd102485f71d6ca0fb5f76746165b7c527144","observation_id":"02b3638e-bf40-4c09-8a81-084307a1f989","resolution":{"observed_at":"2026-05-16T13:12:55.239129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:e4ce1d63557a9d372a36f61b2eb10e48f5d435eb05d269089cfa22b7cd18fd0a","observation_id":"c645131f-79e6-44b3-a2fc-3a13a0221f20","resolution":{"observed_at":"2026-05-10T23:45:52.139304Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In2008 IEEE international conference on robotics and automation","venue":null,"work_id":"ad221e32-7bdb-4a0e-ac30-f2c2fca0768b","year":1928},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:af47221347b4437a38d018a014d4711f43c045a72c22d35675b7c0fb953a2aad","observation_id":"94226142-bfce-48ee-ab90-2fe6d95c5f45","resolution":{"observed_at":"2026-05-16T13:12:55.245023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ad9997b5-4259-4d42-909c-e2eef7efd3d2","year":2018},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:3ba9743cf805e126983678c3e2456adb7643f046f8285756052f92c3d5554823","observation_id":"3c2dcaac-b23e-4d48-98c5-32df28d06a3c","resolution":{"observed_at":"2026-05-16T13:12:55.229610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zewei Zhou, Tianhui Cai, Seth Z Zhao, Yun Zhang, Zhiyu Huang, Bolei Zhou, and Jiaqi Ma","venue":null,"work_id":"f8d88f06-f694-4d85-842c-9160dd4d9494","year":2019},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:de6355c47cc43aac76d139f04db1a6bc14c58983d85b60606e84d3cbf10b3e1c","observation_id":"520c66c2-aa88-437f-9eb9-7774378805fa","resolution":{"observed_at":"2026-05-16T13:12:55.253747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13757","last_updated":"2025-11-05T23:46:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T17:58:50Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","version":3},"cited_work":{"arxiv_id":"2506.13757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13757","snapshot_observed_at":"2026-07-10T08:36:59.854319Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","venue":"cs.CV","work_id":"945172fb-0f3b-43be-88b4-ae61042517e9","year":2025},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"cited_paper":"/paper/2506.13757","citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:73480b5a3cfd21a8e6dcd2fc8a7aa53485dd9bd2bd516da8bfc1dd67034de63c","observation_id":"a00a75dc-a1a0-49ad-ac97-598749d5c958","resolution":{"observed_at":"2026-05-14T21:46:44.401546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We compare pedestrian trajectories when nine agents cross in each scene","venue":null,"work_id":"bef29495-9b9a-4287-bffa-146e1be04716","year":2022},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:539853037f50ea4e91da347dcfcdf3ea3a398dfd6e87c094b61764fab9726eea","observation_id":"438946f1-7e29-4430-88d4-187b56ee472c","resolution":{"observed_at":"2026-05-16T13:12:55.232857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Each column shows the agent’s trajectory (top) and corresponding third-person observations at selected timesteps (bottom)","venue":null,"work_id":"cb9fd194-7040-4fcf-81e2-9aca971beffa","year":2026},"citing_paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T18:53:56.269363Z"},"links":{"citing_paper":"/paper/2604.05525"},"observation_digest":"sha256:eaa592ef1f91ea8acb8c346b4271eab2decbb8f7efc963466aa54ac08140a457","observation_id":"f06f05ef-49c5-4ac7-b0d4-51aed9b60bba","resolution":{"observed_at":"2026-05-16T13:12:55.236363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.05525","last_updated":"2026-04-07T07:24:21Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-07-06T22:54:12.531121Z","submitted_at":"2026-04-07T07:24:21Z","title":"CrowdVLA: Embodied Vision-Language-Action Agents for Context-Aware Crowd Simulation"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":7,"parse_uncertain":0,"unresolved":2,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2604.05525."}