{"as_of":"2026-08-20T19:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9fea43177245eb887f292cdba18a4157cfb2b86acd0ac9d078eec69c967561c2","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T01:03:08.868605Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.06547/citation-record","integrity":"/paper/2508.06547/integrity","json":"/paper/2508.06547/citation-record.json","paper":"/paper/2508.06547"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-06T01:03:07.241486Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.241486Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:1b12126189f9e04b9969d25e45044e5b2723f85256dc2d632c75289790071754","observation_id":"d72305da-94e8-43a1-a922-a6e84323e580","resolution":{"observed_at":"2026-08-06T01:03:07.241486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:10.228003Z","title":"Rt-1: Robotics transformer for real-world control at scale","venue":null,"work_id":"5ed463ee-87a3-4e13-bf18-3959cde03a8f","year":2023},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.318228Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:ef8e9add9e0d22ae6625fa4071ce7a6c3b3af4c904f4630c4ca3dcf157991001","observation_id":"ce610f93-481e-4da1-a1cb-a60dbebb5680","resolution":{"observed_at":"2026-08-06T01:03:10.324756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:10.056260Z","title":"A robust layered control system for a mobile robot","venue":null,"work_id":"c3780f36-cb07-4c15-b36d-fa8f3f369440","year":1986},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.403722Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:bdea0508eacf1f10067a2d566fa549e5a5fad000482fb5aaedf2939cfd1e55b9","observation_id":"023752c2-ff0b-4312-9b00-9b2da3d23fae","resolution":{"observed_at":"2026-08-06T01:03:10.119127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-06T01:03:07.544098Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.544098Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:e8bb9bdd3810e64bdc76f92b56f12906daf11e4fbf930f39db92a7c4336f9b6a","observation_id":"06a4cb5d-e3be-412e-9dae-7627b8c42773","resolution":{"observed_at":"2026-08-06T01:03:07.544098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:09.896298Z","title":"Pybullet, a python module for physics simulation for games, robotics and machine learning, 2016","venue":null,"work_id":"cf2a4321-aafc-4130-bfda-3d95912a1c82","year":2016},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.619503Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:f2bfcfa96411af1e4787260e91744599ba3639773433c5c08b2c90394d0140a9","observation_id":"06e2cc36-b6db-41bf-9b84-5e040ee4807f","resolution":{"observed_at":"2026-08-06T01:03:09.958925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-06T01:03:07.679371Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.679371Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:853540a15b38cd7037ec27f73f4babb6f864efc29010279b291d5e319ec2ab41","observation_id":"1b63e7bf-a121-410b-a01a-a2b45fdd0a97","resolution":{"observed_at":"2026-08-06T01:03:07.679371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:09.653286Z","title":"Introduction to AI robotics","venue":null,"work_id":"31c5af79-95ce-4d54-927a-52e8ec9e0d2c","year":2000},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.823435Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:e7b37a246c0beaedc773727ad70f8fd542a5c05747f272d446df7d6e4fd8ce09","observation_id":"a24e58ea-3148-4d2a-87f9-38b89a0c3f30","resolution":{"observed_at":"2026-08-06T01:03:09.778875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:09.447080Z","title":"Efficient training of artificial neural networks for autonomous navigation","venue":null,"work_id":"53499fd6-7e6d-41de-a334-25f333bef9ff","year":1991},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:07.921468Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:74ec8f55a073bd6df82e48fdf71e6832c14cafd1376a4698ad74e1624eb47b66","observation_id":"f8cfc05d-7b33-4f3b-b281-7c957feb47d1","resolution":{"observed_at":"2026-08-06T01:03:09.565309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:09.285098Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":"8eea104f-bb2c-4e37-bf1e-6fc63789c0f0","year":2023},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.029777Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:9ca15d05197d8a95773f87fcc676195df75fa1713f6748c19a4f71e8f3aac250","observation_id":"6ec4e38c-1727-4601-9cd3-96bcb5200a24","resolution":{"observed_at":"2026-08-06T01:03:09.339155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:08.140072Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.140072Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:1f45a9be3d746686ec0f18500d39685d4df7972952892c178b44660dfe0fa535","observation_id":"ccacc89a-34fb-45bd-a750-15cd255cfa44","resolution":{"observed_at":"2026-08-06T01:03:08.140072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:09.060762Z","title":"Ravens: Train robotic agents to learn pick and place with deep learning for vision-based manipulation in pybullet, 2021","venue":null,"work_id":"fc5d91c0-2f2e-49c7-be30-64ff1e12bbfb","year":2021},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.238892Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:c0e91e797ebc0332f4741a87c7bd7aafc82bfdbea27afe5bdd214b9e572734c8","observation_id":"599ce8c5-73b1-44a0-a006-2d30a29ffddd","resolution":{"observed_at":"2026-08-06T01:03:09.153115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-08-19T01:31:41.184872Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-06T01:03:08.364302Z","title":"robosuite: A modular simulation framework and benchmark for robot learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.364302Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:5b5141ccbcc9fc70b4666ca02ae06e98d9efb5c2777337fee3d48d1876c81d47","observation_id":"48de76b7-f205-4a77-83cc-3bc40bbc7729","resolution":{"observed_at":"2026-08-06T01:03:08.364302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:08.459387Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.459387Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:00ae3175aa29b75d35068fa646725d52dde5600f06f6c07f9e977871e97739f5","observation_id":"e6812d37-f682-4789-bc56-1e5e3c725a35","resolution":{"observed_at":"2026-08-06T01:03:08.459387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:08.602936Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.602936Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:b7cd42d8e07b6fc2ea7e6ae5556bafd4c75c7981509fba6eee4be03ae37a6a6d","observation_id":"7c674c39-35df-4f2a-abfb-031070e987d2","resolution":{"observed_at":"2026-08-06T01:03:08.602936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:08.734127Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.734127Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:2e915fdda7619dc17e2646f1faf451f921bf63eae0ed9439ad8c5516a4f8d88c","observation_id":"7f0dc718-c7cc-4bd3-af75-e0093e588d7f","resolution":{"observed_at":"2026-08-06T01:03:08.734127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:03:08.868605Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T01:03:08.868605Z"},"links":{"citing_paper":"/paper/2508.06547"},"observation_digest":"sha256:51634f34a8ffb5d18f9ad6369d752c165712d928f144a7d362883511f5586e95","observation_id":"99b82fe7-5ee8-4b88-ac37-cc31a7c94215","resolution":{"observed_at":"2026-08-06T01:03:08.868605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.06547","last_updated":"2025-08-06T01:13:05Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T13:49:58.374312Z","submitted_at":"2025-08-06T01:13:05Z","title":"A tutorial note on collecting simulated data for vision-language-action models"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2508.06547."}