{"as_of":"2026-08-08T06:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e0579a779f93074404ef9818277fb2d823105a0cb727e7ff22e8b4db5ffcad6","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:17:20.625249Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.11261/citation-record","integrity":"/paper/2506.11261/integrity","json":"/paper/2506.11261/citation-record.json","paper":"/paper/2506.11261"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1910.07113","last_updated":"2019-10-16T00:59:05Z","snapshot_observed_at":"2026-08-02T15:37:37.200292Z","submitted_at":"2019-10-16T00:59:05Z","title":"Solving Rubik's Cube with a Robot Hand","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07113","snapshot_observed_at":"2026-08-07T04:17:20.316336Z","title":"Akkaya, M","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.316336Z"},"links":{"cited_paper":"/paper/1910.07113","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:2b8a4f3b16c844e62d5073ced9114090f52ccca76535a6f88d945f69441abba8","observation_id":"eb94462f-2413-4790-8921-da9915e13c8a","resolution":{"observed_at":"2026-08-07T04:17:20.316336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-03T00:02:57.373313Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-07T04:17:20.322450Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.322450Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:69a5ef3bc44f826f45cda5d76cd1cf8a5e2607e3f681ce303dd1ec09ea8885bb","observation_id":"e755d191-d6e0-473c-8f66-1db2cf2942c5","resolution":{"observed_at":"2026-08-07T04:17:20.322450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02117","last_updated":"2024-01-04T07:55:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T07:55:53Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02117","snapshot_observed_at":"2026-08-07T04:17:20.328655Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.328655Z"},"links":{"cited_paper":"/paper/2401.02117","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:10524aec5c4e99453a0424e1c3aad0d98b71ccb9e3391e92ab491887faef25ec","observation_id":"7cb664c6-286e-4c97-bd9a-4b90b260d0f4","resolution":{"observed_at":"2026-08-07T04:17:20.328655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-07T04:17:20.333273Z","title":"Brohan, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.333273Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:10deba222ce9c3c8459bd4a71910f30b7c09021d247050ad69e47689ca07951c","observation_id":"fa06b87a-539a-44c7-9584-26d4b6308d31","resolution":{"observed_at":"2026-08-07T04:17:20.333273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T04:17:20.338010Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.338010Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:25b851ccd6537c30b92e0c7b2a5edff6909e8bc77f27feec7e10e59b159971af","observation_id":"c2dd5fb9-675c-4f5c-9911-f9aed0545081","resolution":{"observed_at":"2026-08-07T04:17:20.338010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-07T04:17:20.343298Z","title":"Driess, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.343298Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:62964cce0dde3a0e1e91d494fb744f009abe6ec902bfa7faf474ae5f0f1d781a","observation_id":"98ba64aa-9f76-4d82-9b95-0bf3e5d59bf1","resolution":{"observed_at":"2026-08-07T04:17:20.343298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-07T04:17:20.349175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.349175Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:39ef8ae2010c878b499f530efd5665bc97075b40bc8f621fe418153f3a75e7fe","observation_id":"d108a885-f84f-486e-ac04-ab369db8ba9b","resolution":{"observed_at":"2026-08-07T04:17:20.349175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-07T04:17:20.354909Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.354909Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d8e51651468ca04f841660626b4cf9edbee6dd9bfa6df44aca3c199f8513a9fe","observation_id":"f94e78b0-ea1e-4d8e-a76c-ea0778d8adef","resolution":{"observed_at":"2026-08-07T04:17:20.354909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.624124Z","title":"Vuong, S","venue":null,"work_id":"1b4c7628-2af8-475a-92a9-5d60cfd1c07b","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.360654Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:8314e03e154372bcb7f8008b29db14dc83cc775b89643105dd06635b9ccb8b6d","observation_id":"8d0ecb3c-e505-41fc-8189-13c351ecf409","resolution":{"observed_at":"2026-08-07T04:17:21.628652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.607978Z","title":"Khazatsky, K","venue":null,"work_id":"3078904d-1d18-4d6e-afd5-ef665a4bc772","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.365513Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d109476931adc9f865f91ab7d81180cf9f725bd0d66e7d28dc2d9d254ad4401c","observation_id":"b9045ca7-9ab2-4999-8267-1363a777bb61","resolution":{"observed_at":"2026-08-07T04:17:21.613176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-04T23:08:22.516431Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-07T04:17:20.371358Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.371358Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:f75bf3b8dde1c64052c4b70e3ea80d17764f23d2df778eb1320467ece95ab1d0","observation_id":"cd377d39-3a64-4ece-a25f-ed9e34258450","resolution":{"observed_at":"2026-08-07T04:17:20.371358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.592531Z","title":null,"venue":null,"work_id":"3628b70b-507e-4926-bde7-368422425fff","year":2022},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.376325Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:1375a3e1b393352cb721dbf3014c7cbd8bcc12b1c4997401619d7b6a97403d78","observation_id":"12fc1964-3b7d-4d3e-9519-7fd9814711e8","resolution":{"observed_at":"2026-08-07T04:17:21.597312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08191","last_updated":"2024-05-28T00:37:02Z","snapshot_observed_at":"2026-08-05T06:18:26.955637Z","submitted_at":"2024-02-13T03:25:33Z","title":"THE COLOSSEUM: A Benchmark for Evaluating Generalization for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08191","snapshot_observed_at":"2026-08-07T04:17:20.380883Z","title":"Pumacay, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.380883Z"},"links":{"cited_paper":"/paper/2402.08191","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d3b27f7b2d899dce7aa0c8d76b196fad47dfb51be9332377a44a82a7d01ae075","observation_id":"4bcee2c1-338d-44a2-94de-2cbd72411686","resolution":{"observed_at":"2026-08-07T04:17:20.380883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.576880Z","title":"Garcia, S","venue":null,"work_id":"0d5e6f10-a4d3-41ac-bcd4-4683d75c52c6","year":2025},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.385786Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:f8abaa612c3b54bf73d5f980c398ae25b76682bf346eba44348262d98c672c2f","observation_id":"5a3e8f2d-458d-499f-bf02-b842cc4e1ad2","resolution":{"observed_at":"2026-08-07T04:17:21.581936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:20.390230Z","title":"Liang, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.390230Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:aae60ee61cf56a749dae029a06f321caaf8bc02d30fe26aaf782c7920c6c86d6","observation_id":"a09d30ec-5c6a-40e5-8409-be43cbe5b834","resolution":{"observed_at":"2026-08-07T04:17:20.390230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-07T04:17:20.394428Z","title":"Huang, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.394428Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:49d034c44dc92788d6f9c44e9ed77d820d7b495cd460c0f9536e5697fa73f63d","observation_id":"673eca51-cb54-4b20-9cae-6b82f59c7a03","resolution":{"observed_at":"2026-08-07T04:17:20.394428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-07T04:17:20.399107Z","title":"Bjorck, F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.399107Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:41e3f6acb2a898b17c6844a6dc737566cfd40e82fb0316b61b608f4e12ef3386","observation_id":"e2deed5a-6779-4773-a8da-f61fdfaa46fa","resolution":{"observed_at":"2026-08-07T04:17:20.399107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.551938Z","title":"Llama 3 model card, 2024","venue":null,"work_id":"0fe270e5-a732-47f5-a2e2-fc7559e39f97","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.404207Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:6c092277d1860ae34872d45609239b7931f7a415cee845e53b474c4641532f1d","observation_id":"7101edf7-db3e-4f29-8787-f179ac70480a","resolution":{"observed_at":"2026-08-07T04:17:21.556422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.536224Z","title":"Huang, P","venue":null,"work_id":"16c41bab-9859-4696-a969-26763a7da98d","year":2022},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.414320Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:c17a8493a673f42c68c687ee7ecda9a2f44f296e3429a4f39437fcc2b48cede1","observation_id":"0ae1ab5c-46e7-4897-9e68-7661ebd23436","resolution":{"observed_at":"2026-08-07T04:17:21.542119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.521432Z","title":"Brohan, Y","venue":null,"work_id":"0e65469d-0896-4b2f-8b3d-082c47f5ca0a","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.419923Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:4eac1b6302a8232449506460b712cb2b387951c75fff740efb09751c1be00d5c","observation_id":"25b21b93-9bfb-44c2-83d8-921431a450d4","resolution":{"observed_at":"2026-08-07T04:17:21.525869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.506135Z","title":"Michał, C","venue":null,"work_id":"e6d0c6ac-e3c6-45a2-9aa3-45ce230e6f58","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.424816Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d077ff68371d4e197166e9421b7f43b626c285781358c2e65a1f892eff6e146f","observation_id":"89ee712f-d5c8-4243-9f00-1c2cc99606ac","resolution":{"observed_at":"2026-08-07T04:17:21.511912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20095","last_updated":"2025-01-30T17:34:37Z","snapshot_observed_at":"2026-07-06T18:38:38.104034Z","submitted_at":"2024-06-28T17:59:12Z","title":"LLaRA: Supercharging Robot Learning Data for Vision-Language Policy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20095","snapshot_observed_at":"2026-08-07T04:17:20.429643Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.429643Z"},"links":{"cited_paper":"/paper/2406.20095","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:605b194608ea59f40b3dbe6c0717c3a7e9490adeb6ac08fe733d8519ffd8dcf7","observation_id":"75f983ac-1b50-4cba-a53f-e394bf2ae2e4","resolution":{"observed_at":"2026-08-07T04:17:20.429643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10721","last_updated":"2024-06-15T19:22:51Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-15T19:22:51Z","title":"RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10721","snapshot_observed_at":"2026-08-07T04:17:20.434960Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.434960Z"},"links":{"cited_paper":"/paper/2406.10721","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d36db29bb825612bc20585670100ca3b1c83bd9ba1863a3d6913bff013f12494","observation_id":"97df0da4-788d-40b8-96b0-9f6b05992343","resolution":{"observed_at":"2026-08-07T04:17:20.434960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04001","last_updated":"2025-11-03T17:35:29Z","snapshot_observed_at":"2026-08-08T01:58:42.644918Z","submitted_at":"2025-01-07T18:58:54Z","title":"Sa2VA: Marrying SAM2 with LLaVA for Dense Grounded Understanding of Images and Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04001","snapshot_observed_at":"2026-08-07T04:17:20.439993Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.439993Z"},"links":{"cited_paper":"/paper/2501.04001","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:b595d96f9743afffe47ced04d5c6a6164bf911a5acaaf119545007875181fa5a","observation_id":"9033c848-8ea8-4748-aaa5-a37a289adc2d","resolution":{"observed_at":"2026-08-07T04:17:20.439993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.489953Z","title":"James, Z","venue":null,"work_id":"14c3159d-2c6b-4905-8541-6912609eb1cc","year":2020},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.444842Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:2169b59a7f4756fdf4f0798419a6422569d6d929811754fbde2a5b7702b4a73a","observation_id":"84d27002-46cb-4d10-af1a-5b5f4ca3cb73","resolution":{"observed_at":"2026-08-07T04:17:21.494909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.474220Z","title":null,"venue":null,"work_id":"833feb68-9a10-4369-b38d-2cc8109aaaed","year":2021},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.449841Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:63d9066d211a8d90995f2890a50107ee79eb9d2765776a75175b154cb70e6d87","observation_id":"7a4936a5-fb06-4b93-bd8f-8624aed23b1b","resolution":{"observed_at":"2026-08-07T04:17:21.478709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.458604Z","title":"Lynch, A","venue":null,"work_id":"d7ca2c4c-aef1-4e7c-886a-7b814725786c","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.454819Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:9bcba66ef5cc76c11389a34678ffdfd12940efb165c0af0fd3b417d90e53917e","observation_id":"69d42033-3635-45a0-84c4-a02e8c01a9cb","resolution":{"observed_at":"2026-08-07T04:17:21.463825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.442334Z","title":"Stepputtis, J","venue":null,"work_id":"de2ec5e6-3250-4fd6-b174-58b4ef09d829","year":2020},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.460108Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:b696dd95b1213b6e3b93b6f0529ec513958a84d12dc96b9b686e2da0bcc32155","observation_id":"a07a6a99-544b-4c9c-be28-ce36724bb71f","resolution":{"observed_at":"2026-08-07T04:17:21.446945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.428014Z","title":"Kalashnikov, A","venue":null,"work_id":"ab17d31b-c73d-4fa0-b09b-e6976a862619","year":2018},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.464528Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:2fdadb28d2c83c54c9e14c3733b7d794812230a5f073c90c460b097964046ff4","observation_id":"3cc8db9e-1799-4d76-b951-5bb02ddc6ced","resolution":{"observed_at":"2026-08-07T04:17:21.432517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.412032Z","title":null,"venue":null,"work_id":"e7367c0a-546b-4c18-bc74-10cb3d12a28d","year":2022},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.468969Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:24e6cd85d9f1d29dd36e484214ec7778d90dd67e4383851916f8628f69f9de5f","observation_id":"64fc2d33-8aea-4ddf-bd95-073762b72755","resolution":{"observed_at":"2026-08-07T04:17:21.417318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.394236Z","title":"Guhur, S","venue":null,"work_id":"2ff59bb2-8cc6-47d8-8ceb-2b9c75a71bf3","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.473238Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:0e57503d752c5d9787c250328284adc770563e3581e556956f6930803ac7d78f","observation_id":"f6c72887-83b4-452b-8e80-aaf402291d2e","resolution":{"observed_at":"2026-08-07T04:17:21.399904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.377974Z","title":"Shridhar, L","venue":null,"work_id":"4cbbc1f2-0b5d-4623-aadc-bd88b7281450","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.477366Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:ff2c1fa6de54dcb8acff3def2cf4f031a6b651710b3130826457669722af8377","observation_id":"36fe8a16-88b4-4795-a2df-668f1406662c","resolution":{"observed_at":"2026-08-07T04:17:21.383181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.362206Z","title":"Goyal, J","venue":null,"work_id":"a27c3398-ccd8-4a9f-be6b-43db618451f7","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.481674Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:0e300f51263d1e9ff9135b791e9999d7631bfb89a1affe709585542a5c6b86f0","observation_id":"8d9daf24-99a4-4908-a342-2200575329ed","resolution":{"observed_at":"2026-08-07T04:17:21.367866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.346682Z","title":null,"venue":null,"work_id":"cf905bc5-faf3-41a4-b3b5-5966506d25f6","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.486409Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:e3ffde464ad40c6c786adf854b54498d573e5660a35f977ce26ca8c9835212ad","observation_id":"53b08bc7-61b9-4fd2-b5b5-79e203d1ca54","resolution":{"observed_at":"2026-08-07T04:17:21.351340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.332182Z","title":null,"venue":null,"work_id":"e1884d2d-38ef-4e33-ab11-e7c8d516fcfd","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.491406Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:8e331f8915879065b30156fe72f0bd17fcb186c13cac0100fdda013ade52e4fc","observation_id":"5fb78202-392d-4c96-aa26-b17ff767f5e1","resolution":{"observed_at":"2026-08-07T04:17:21.336825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:20.495660Z","title":"Gervet, Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.495660Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d3a780968520760e2168beb856751a4ff21bc5097995480b5d84fa8e739e84a3","observation_id":"277715f0-7f11-4a15-9f5d-071afdb4cb30","resolution":{"observed_at":"2026-08-07T04:17:20.495660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10885","last_updated":"2024-07-25T14:30:22Z","snapshot_observed_at":"2026-07-06T17:31:17.058043Z","submitted_at":"2024-02-16T18:43:02Z","title":"3D Diffuser Actor: Policy Diffusion with 3D Scene Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10885","snapshot_observed_at":"2026-08-07T04:17:20.500204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.500204Z"},"links":{"cited_paper":"/paper/2402.10885","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:9a55b824639cb4efaef64586be6e4537cc791a4f7b8940e8b23ba4fed933845d","observation_id":"74e52084-b259-497b-91ac-cf28b90e05e7","resolution":{"observed_at":"2026-08-07T04:17:20.500204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.307856Z","title":"Goyal, V","venue":null,"work_id":"1d7ec024-632c-4be1-a479-09f63d8c732d","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.504659Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:f8a2984e897c7ea2bdc93aa5661d2f070ac6782ad4f4a886b89810b495af5c58","observation_id":"a7e397fd-3505-450b-a594-a0f481336511","resolution":{"observed_at":"2026-08-07T04:17:21.312397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18722","last_updated":"2024-10-13T15:19:58Z","snapshot_observed_at":"2026-07-06T18:37:34.799583Z","submitted_at":"2024-06-26T19:42:08Z","title":"Towards Open-World Grasping with Large Vision-Language Models","version":4},"cited_work":{"arxiv_id":"2406.18722","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18722","snapshot_observed_at":"2026-08-07T04:17:20.834016Z","title":"Towards Open-World Grasping with Large Vision-Language Models","venue":"cs.RO","work_id":"291f2b3c-d919-4f8a-bb13-cff7264a4270","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.509264Z"},"links":{"cited_paper":"/paper/2406.18722","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:3d7bbddb81f5b95eee324edd55ab79d435329dd014e735cbd3ad80be0d4035d9","observation_id":"71bfa200-0d28-45f8-bfc5-7e1a33e904af","resolution":{"observed_at":"2026-08-07T04:17:20.843086Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.292548Z","title":"James, K","venue":null,"work_id":"c9f48cb1-22b4-485e-8b2e-ac98eee6d8cd","year":2022},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.514653Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:59d6e2d3cd69219a4398562b18cadaa6206ed0cc10b3c9c0d10fcaacaec5e7a4","observation_id":"80dc5c84-c353-413f-b6de-92af3918f175","resolution":{"observed_at":"2026-08-07T04:17:21.297273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07343","last_updated":"2024-09-11T15:25:57Z","snapshot_observed_at":"2026-08-02T22:00:24.820420Z","submitted_at":"2024-09-11T15:25:57Z","title":"Learning Robotic Manipulation Policies from Point Clouds with Conditional Flow Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07343","snapshot_observed_at":"2026-08-07T04:17:20.518895Z","title":"Chisari, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.518895Z"},"links":{"cited_paper":"/paper/2409.07343","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:0a8e3dfa28ff88595d22ea6a35f003878af0294698da58016eafb9981852ae43","observation_id":"7ca0eca6-5be3-4cf7-955e-665ed85ce146","resolution":{"observed_at":"2026-08-07T04:17:20.518895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:20.523767Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.523767Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d2cce17127a3f4c53f974f1657554013d35513c419613e79e2016b9ab711d17d","observation_id":"520936ce-99da-4160-881d-67e8665bbc9e","resolution":{"observed_at":"2026-08-07T04:17:20.523767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11550","last_updated":"2023-02-22T18:47:51Z","snapshot_observed_at":"2026-08-05T16:16:51.134330Z","submitted_at":"2023-02-22T18:47:51Z","title":"Scaling Robot Learning with Semantically Imagined Experience","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11550","snapshot_observed_at":"2026-08-07T04:17:20.528345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.528345Z"},"links":{"cited_paper":"/paper/2302.11550","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:774fbee5e09bba3f126092f53ff66cb21f034d5f270bc008c40fbb0fa9f46ac9","observation_id":"b00bbbdb-fac0-4791-84ae-2345fb8d8659","resolution":{"observed_at":"2026-08-07T04:17:20.528345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-07T04:17:20.532603Z","title":"Kirillov, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.532603Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:227223f6acea98d43636cbf30815085777f9c709aee62aefc031339cf4339ac4","observation_id":"f8304928-e766-4ea1-b815-cec179cbbe01","resolution":{"observed_at":"2026-08-07T04:17:20.532603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17842","last_updated":"2023-12-24T03:48:40Z","snapshot_observed_at":"2026-08-07T02:37:30.672574Z","submitted_at":"2023-11-29T17:46:25Z","title":"Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17842","snapshot_observed_at":"2026-08-07T04:17:20.537219Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.537219Z"},"links":{"cited_paper":"/paper/2311.17842","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:bdcb76a3c40fc279e32a38b07a66e1efff23bc2da07232df5daaf5fed9b6820b","observation_id":"19db234a-03e3-41df-b5c5-02f98bd13859","resolution":{"observed_at":"2026-08-07T04:17:20.537219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.267326Z","title":null,"venue":null,"work_id":"d0f91cfd-8f2a-4c75-92f8-56dd142a2f39","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.541719Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:8fc13020bc9a694de2b17f8a4575c495c7adea548e602d50a77dd5afac0bee74","observation_id":"dcfd1644-6e9a-4237-8fb4-0146520aa9a8","resolution":{"observed_at":"2026-08-07T04:17:21.272533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.252067Z","title":null,"venue":null,"work_id":"2edf78c2-eb8c-4ac8-b418-87e1ed86400c","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.546134Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:ab5776498a87321a6166ce14292598520463760d69c9cdaba6ddd7a8ad6198ba","observation_id":"2e9f2779-0cd5-45f2-abd7-f78698d3be3b","resolution":{"observed_at":"2026-08-07T04:17:21.256851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.237248Z","title":null,"venue":null,"work_id":"2ba6c0cd-6063-4e20-9ab0-69f703f4ed58","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.551621Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:657c568609f20d6ecf3f71011e3aa52c97c1d167e302a03709ace8754418375f","observation_id":"c6677b03-15e5-4a18-b3c9-a3e025a9e69d","resolution":{"observed_at":"2026-08-07T04:17:21.242579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-07T04:17:20.556388Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.556388Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:5736486dd30bf55738995af0dc599dbdd045a6ba75daeae29c3b78b512580dc5","observation_id":"aa1a8561-b796-4a98-826c-4f0b50408481","resolution":{"observed_at":"2026-08-07T04:17:20.556388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-07T04:17:20.561605Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.561605Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:1fdb1319f2742fdab7b196cc8f7caf3a33f6ff734a5897f93dcaabea69d57fff","observation_id":"a94fdefb-d027-447a-8499-1b39e0f1d165","resolution":{"observed_at":"2026-08-07T04:17:20.561605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-07T04:17:20.567572Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.567572Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:d081b9bb294f5ae79980365eb860dac9c254403fd4a24148a289ccb53126da2f","observation_id":"a3a3b0f4-e51b-416d-80fe-b8c67d6cfdfd","resolution":{"observed_at":"2026-08-07T04:17:20.567572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07704","last_updated":"2023-10-11T17:55:15Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T17:55:15Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07704","snapshot_observed_at":"2026-08-07T04:17:20.572898Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.572898Z"},"links":{"cited_paper":"/paper/2310.07704","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:38efef47a272d27ee83c48fa6a76c7852ff7775e4d627a545a3f756f6d029923","observation_id":"af00be43-716c-4218-80f0-75e43f33695b","resolution":{"observed_at":"2026-08-07T04:17:20.572898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-07T04:17:20.578244Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.578244Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:131d707f7f96ec3226767a8c96f97a9f4da8912eba8445842a7b0c7a2165527d","observation_id":"c2c4a2e7-09d2-4010-88e4-2c94e94e75fe","resolution":{"observed_at":"2026-08-07T04:17:20.578244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.219064Z","title":null,"venue":null,"work_id":"767d5d4a-5064-4f1b-be8a-a163eae8025f","year":2023},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.583654Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:190522398e92851a32d2b2ab78f1f194664df3497cd453b14bc0fbab79ae8e16","observation_id":"213e051b-5e57-4a95-96f3-de1630dd36fd","resolution":{"observed_at":"2026-08-07T04:17:21.225275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.201080Z","title":null,"venue":null,"work_id":"09e199b6-62f9-433d-bc8e-eb67613c30f3","year":2025},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.588330Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:a3ffb9fb55d166df1da9aaafff403aac5a6c326309cbe1a6e3df59099f2ad00d","observation_id":"e218ac51-fb1d-4edb-90f5-e3518de81ef1","resolution":{"observed_at":"2026-08-07T04:17:21.206237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.185664Z","title":"Zhang, Z","venue":null,"work_id":"2f23f492-ba09-433e-a042-963584c03fa8","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.593347Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:8c2271cd263970a737a83900968fd56cf640ba7363b55057f1a4da3c664bd5f8","observation_id":"e062b305-451c-470f-aef3-e1d83404f807","resolution":{"observed_at":"2026-08-07T04:17:21.190282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.169569Z","title":null,"venue":null,"work_id":"1cecf18c-c9fa-4658-8fa1-9c54f03eeb94","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.597542Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:959a4f39d55d865c4737dd3e069a42d264398152de68769246a66838abba4a17","observation_id":"a219b2ce-6712-4a9c-a088-0ff78f01890a","resolution":{"observed_at":"2026-08-07T04:17:21.174133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.154000Z","title":"Zhang, H","venue":null,"work_id":"05ed1ae7-e16b-4f39-9713-cc180e3da513","year":2025},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.602369Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:25175493a10ccad64ccd5a0ff04178afd38ed1ef2060d23f78e427b5ea1d4901","observation_id":"6ba09588-ab86-4550-91fe-eb7d5121e677","resolution":{"observed_at":"2026-08-07T04:17:21.159049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.139302Z","title":"Rasheed, M","venue":null,"work_id":"fb0e49ad-6195-4aab-b9ca-3eccc6c92f81","year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.606744Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:6852e68b674c3c8c598ea9e1b1fdaac43cc4777aef81d67246d03ddf6d6ba684","observation_id":"c26fa883-8687-4ef4-b747-c587abb6804d","resolution":{"observed_at":"2026-08-07T04:17:21.143954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:20.611062Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.611062Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:a71a17bb7cf19b849953c8fe51a66b78b299b6e693f03f4e2bb9afdec5b65159","observation_id":"7e87e4cd-935f-4de6-9f77-a5bd5612f274","resolution":{"observed_at":"2026-08-07T04:17:20.611062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-07T04:17:20.615628Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.615628Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:6795647df6523e75e70768eee957b212c6610808d55dfed234faa5a275e8da44","observation_id":"07c6daeb-77c2-4da7-abd7-b66771290a34","resolution":{"observed_at":"2026-08-07T04:17:20.615628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T04:17:20.620101Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.620101Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:70052a908c3b1401ab61d5769332d84620362822686401df31b71de8935c9c7c","observation_id":"72feff3f-591d-45a6-b4fb-63597cd9a98a","resolution":{"observed_at":"2026-08-07T04:17:20.620101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:21.114418Z","title":"Rasley, S","venue":null,"work_id":"a9fa809c-960a-42ca-b59f-6a9276ad22dc","year":2020},"citing_paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:20.625249Z"},"links":{"citing_paper":"/paper/2506.11261"},"observation_digest":"sha256:73b1cbae0bf46cbf43bdb9ff087e7d296696be5c8537d50ea91c0dccdc66dfda","observation_id":"a30883b0-5813-45fd-af71-dee9502b5693","resolution":{"observed_at":"2026-08-07T04:17:21.119109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.11261","last_updated":"2025-06-12T20:04:31Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T12:49:19.052077Z","submitted_at":"2025-06-12T20:04:31Z","title":"Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2506.11261."}