{"as_of":"2026-08-23T08:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61d7f443453bbad365b9a51f5f82060c693a02321b06c446709e046f9aef3295","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T17:19:04.477325Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:13:43.160700Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27284","snapshot_observed_at":"2026-08-01T14:13:43.160700Z","title":"FineVLA: Fine-grained instruction alignment for steerable vision-language-action policies, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18840","last_updated":"2026-07-21T08:25:37Z","snapshot_observed_at":"2026-08-17T08:10:57.536978Z","submitted_at":"2026-07-21T08:25:37Z","title":"WorldScape Policy 2.0: Empowering Steerable World Action Modeling with Reasoning-Augmented Memory","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T14:13:43.160700Z"},"links":{"cited_paper":"/paper/2605.27284","citing_paper":"/paper/2607.18840"},"observation_digest":"sha256:6a2ee82e5f5d590af37d071d47810675f5b65e3b480c016ac81375f391f7813b","observation_id":"7c868e7c-0a96-43be-8bcc-ce4d9ef74c5f","resolution":{"observed_at":"2026-08-01T14:13:43.160700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.27284/citation-record","integrity":"/paper/2605.27284/integrity","json":"/paper/2605.27284/citation-record.json","paper":"/paper/2605.27284"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-08-11T15:03:01.640683Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"cited_work":{"arxiv_id":"2604.15483","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.15483","snapshot_observed_at":"2026-07-10T19:47:32.631418Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","venue":"cs.LG","work_id":"7391297f-4dff-465c-9790-cb760a2c0542","year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2604.15483","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:bed7b9ae503f4b0fe28653dbdd29b868022c81e46484073b6fe710bc1dce4a2b","observation_id":"77170b98-4ed4-43b6-906b-8cbedf936175","resolution":{"observed_at":"2026-06-29T17:23:44.921783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18692","last_updated":"2026-02-26T03:30:01Z","snapshot_observed_at":"2026-08-11T08:52:29.230329Z","submitted_at":"2026-01-26T17:08:04Z","title":"A Pragmatic VLA Foundation Model","version":2},"cited_work":{"arxiv_id":"2601.18692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.18692","snapshot_observed_at":"2026-07-10T07:26:54.460833Z","title":"A Pragmatic VLA Foundation Model","venue":"cs.RO","work_id":"9b5a37fb-5c5d-4fbb-a804-d518173f2011","year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2601.18692","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:637b40e2d3f15b60273d5bb85f88421bec1b58e4361b5f751f2ad58686e48dd1","observation_id":"10a67a13-bdf8-445b-b54a-24e0e0b28c21","resolution":{"observed_at":"2026-06-29T17:23:44.921456Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"Nvidia isaac gr00t","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:d248968cf9d1bba0cd5cbb58d4366e96f6e1cdb7a2fc4334e32cda85a5563914","observation_id":"fac17dfd-4895-4af0-b7e7-986465c4ffea","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:5dfcc3d854bd0d63c1a2a6f8e2f04ed75404c32e4f5f829c9ebe3b1b85f9671d","observation_id":"be5c5a54-86e7-4d41-9f8b-7772ffd671ae","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-13T13:59:48.091257Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":"2310.08864","doi":"10.48550/arxiv.2310.08864","metadata_source":"pith","pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","venue":"cs.RO","work_id":"62f0fb6c-e6ae-4dc4-95a4-d9dd64b240e8","year":2023},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:20c73c49763bd676c3b4d2de7bbe1fab096d6b3f5fcfe4d8b79ae106314a21ea","observation_id":"3a975193-7074-45d3-8558-e5f2fbc37bd3","resolution":{"observed_at":"2026-06-29T17:23:44.919185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-08-20T09:40:44.825072Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":"2410.07864","doi":"10.48550/arxiv.2410.07864","metadata_source":"pith","pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","venue":"cs.RO","work_id":"12319725-bc7d-4c32-a229-ad270a7460bc","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:161ccc00b1e07200153adec012c7ae6c2d0f3d30022c5f93f33d1ee80711840e","observation_id":"48be4c0f-c411-4ecf-af9c-39d32773f460","resolution":{"observed_at":"2026-06-29T17:23:44.926072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00899","last_updated":"2023-11-01T23:40:07Z","snapshot_observed_at":"2026-08-16T14:46:42.725649Z","submitted_at":"2023-11-01T23:40:07Z","title":"RoboVQA: Multimodal Long-Horizon Reasoning for Robotics","version":1},"cited_work":{"arxiv_id":"2311.00899","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.00899","snapshot_observed_at":"2026-07-05T11:41:02.660093Z","title":"In","venue":"cs.RO","work_id":"e9b50329-dbe8-4561-baf4-9128c5cef20c","year":2023},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2311.00899","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:729d99f5bd7f3d9282a705212a646d61477a29619c82339704a8a2a8024e5daa","observation_id":"a37e55ad-f482-454b-93ff-37e929cbe22d","resolution":{"observed_at":"2026-06-29T17:23:44.942418Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"Robobench: A comprehensive evaluation benchmark for multimodal large language models as embodied brain, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:eae72c5fe950907d18610bcdbc86df3ad653c396cb70cfbe0b07be6178bf9c61","observation_id":"e405e4fd-0188-42b7-9f12-26f5a907802a","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.00885","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:23:44.949371Z","title":"Handyvqa: A video qa benchmark for fine-grained hand-object interaction dynamics","venue":null,"work_id":"587b929d-a69c-4434-9df0-f40566017409","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:d91e2aa82c01052aec82dcf1e1c8b26abf53284b580bf19bd54ad83a0dcbc12d","observation_id":"5e99ec83-6d05-43fd-97e4-d30d0a10d217","resolution":{"observed_at":"2026-06-29T17:23:44.950904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"Qwen3.5: Towards native multimodal agents, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:90cd28aa221812f8ffa171b4fa333cf19ede1f250c03995cca6fa467750ca375","observation_id":"51a173f8-9cc3-48b2-acce-31f5e3587a7b","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12952","last_updated":"2024-01-17T22:41:29Z","snapshot_observed_at":"2026-08-21T21:07:33.912850Z","submitted_at":"2023-08-24T17:41:20Z","title":"BridgeData V2: A Dataset for Robot Learning at Scale","version":3},"cited_work":{"arxiv_id":"2308.12952","doi":"10.48550/arxiv.2308.12952","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.12952","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bridgedata v2: A dataset for robot learning at scale","venue":"arXiv (Cornell University)","work_id":"a7522d2b-ba04-44df-978a-84e147c5549c","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2308.12952","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:791822c2bb4f5c3aed6cc567a261df6b18489c143492b874ff1b2528c9d25537","observation_id":"2427e160-c65a-4a94-a6b3-205544a521bd","resolution":{"observed_at":"2026-06-29T17:23:44.954034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"Bc-z: Zero-shot task generalization with robotic imitation learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:04ff02fc72fd542557340d27dc546be986671fcb2fbd254da2fa64c0d2414112","observation_id":"bcc11873-90cf-4d29-8f84-5bf953f107aa","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.02005","last_updated":"2022-02-04T07:30:48Z","snapshot_observed_at":"2026-08-20T07:55:26.054110Z","submitted_at":"2022-02-04T07:30:48Z","title":"BC-Z: Zero-Shot Task Generalization with Robotic Imitation Learning","version":1},"cited_work":{"arxiv_id":"2202.02005","doi":"10.48550/arxiv.2202.02005","metadata_source":"arxiv_reference","pith_arxiv_id":"2202.02005","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bc-z: Zero-shot task generalization with robotic imitation learning","venue":"arXiv (Cornell University)","work_id":"3f7679c8-cc68-4d52-ba64-3ace8c774545","year":2022},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2202.02005","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:12eb8a04861378f256fcc924b3130ceb3afaae09d4f9938ac9537467ddb15954","observation_id":"c240c5ab-de63-4096-bbfd-754a48dcc04b","resolution":{"observed_at":"2026-06-29T17:23:44.943146Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":"2212.06817","doi":"10.48550/arxiv.2212.06817","metadata_source":"pith","pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","venue":"cs.RO","work_id":"e11bda85-8531-46bc-a07f-d0ade3643ab1","year":2022},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:c170d07ed5c92a0e62513f367c909ba0653565f612ebc6887a99c0d1b0d2f7f7","observation_id":"03f9d295-e0bd-466e-a141-a0ffbb246c38","resolution":{"observed_at":"2026-06-29T17:23:44.932205Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-08-14T02:52:34.768729Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":"2509.00576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-07-08T07:14:45.460259Z","title":"Galaxea open-world dataset and G0 dual-system VLA model","venue":"cs.RO","work_id":"568af32f-f647-4c11-a106-65ddfa305082","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:612426084dbb371a95964fb6946414f56ab647f38f3adbd444f54c8183c62f6c","observation_id":"9211b989-36e3-452d-ac47-febbf02a7331","resolution":{"observed_at":"2026-06-29T17:23:44.940463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2025.xxi.152","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL http://dx.doi.org/10.15607/RSS.2025.XXI.152","venue":null,"work_id":"d209311a-5eb8-4d9d-b781-b07765e9dc12","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:eb511454f67212e4838aeb9e42b663d71b0c610de9d33b40694664a37dbedb51","observation_id":"87882627-16bc-4000-8218-d2bb3983579d","resolution":{"observed_at":"2026-06-29T17:23:44.401136Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.24653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T01:44:26.117668Z","title":"Robomind 2.0: A multimodal, bimanual mobile manipulation dataset for generalizable embodied intelligence","venue":null,"work_id":"3be0dda9-d954-48d9-b094-2369a1f83699","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:0c901c1de5a3e4be1ec4672f9e94ce073e3a97d1c5469c559061f8baf72b9785","observation_id":"9e89b392-c8c2-444d-8ec5-c6607d7046c3","resolution":{"observed_at":"2026-06-29T17:23:44.947959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17441","last_updated":"2026-04-13T12:31:35Z","snapshot_observed_at":"2026-08-14T08:08:04.254754Z","submitted_at":"2025-11-21T17:39:22Z","title":"RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation","version":3},"cited_work":{"arxiv_id":"2511.17441","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17441","snapshot_observed_at":"2026-07-10T04:16:48.642593Z","title":"RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation","venue":"cs.RO","work_id":"bb5f869d-fc3a-4506-949c-65ae53321631","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2511.17441","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:c0012bdc3d144b93c384d1927f67715d0981ca2a25fa16d9f0a3cf9f2bcd4fbb","observation_id":"4848680e-69f9-4d71-8f6d-93e49743127d","resolution":{"observed_at":"2026-06-29T17:23:44.911537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"Rh20t: A comprehensive robotic dataset for learning diverse skills in one-shot,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:56f4abb4910e4d6f8789ef5377dfa27e702446257685ab56ab4e79f66ce1ebfc","observation_id":"28488e8b-e62f-4778-a6c2-45c888654db1","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00595","last_updated":"2023-09-26T10:47:35Z","snapshot_observed_at":"2026-08-17T23:49:22.371557Z","submitted_at":"2023-07-02T15:33:31Z","title":"RH20T: A Comprehensive Robotic Dataset for Learning Diverse Skills in One-Shot","version":2},"cited_work":{"arxiv_id":"2307.00595","doi":"10.48550/arxiv.2307.00595","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.00595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RH20T: A comprehensive robotic dataset for learning diverse skills in one-shot","venue":"arXiv (Cornell University)","work_id":"d0404087-2d28-482f-8b50-8400d35d315e","year":2023},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2307.00595","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:81fa5b2b6d95e8d6177cc6175a226ff79a52162ba118355fb944c59fae0f8382","observation_id":"5b6b1bf4-fe99-4fe9-8c7b-01841233f225","resolution":{"observed_at":"2026-06-29T17:23:44.916841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":"2403.12945","doi":"10.48550/arxiv.2403.12945","metadata_source":"pith","pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","venue":"cs.RO","work_id":"13253de2-3d89-415c-8c2f-3adb25d4c337","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:9903444cad6ffd71b9880e09bd48eaae694edbe7451818ff9dee2ac0dca49118","observation_id":"85361763-a493-469c-b7a3-acf63262d240","resolution":{"observed_at":"2026-06-29T17:23:44.892194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05014","last_updated":"2026-04-06T17:59:21Z","snapshot_observed_at":"2026-08-11T13:37:09.952888Z","submitted_at":"2026-04-06T17:59:21Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","version":1},"cited_work":{"arxiv_id":"2604.05014","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05014","snapshot_observed_at":"2026-07-10T07:26:54.478996Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","venue":"cs.RO","work_id":"e9be5436-00f8-4b43-b82a-ff154145e079","year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2604.05014","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:d30e793ecc4a0e1572327563b8cb11e76ba7062ffa0c997e082c31a854a082b4","observation_id":"85ba6212-81ac-442b-ae70-be8981b9601d","resolution":{"observed_at":"2026-06-29T17:23:44.894826Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02920","last_updated":"2025-04-16T17:31:39Z","snapshot_observed_at":"2026-08-21T10:59:43.366967Z","submitted_at":"2024-09-04T17:59:52Z","title":"RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins (early version)","version":3},"cited_work":{"arxiv_id":"2409.02920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02920","snapshot_observed_at":"2026-06-29T17:23:44.895969Z","title":"RoboTwin: Dual-arm robot benchmark with generative digital twins","venue":null,"work_id":"4083e7d6-a2ac-4347-8dae-fed378b42744","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2409.02920","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:bf7b1900d7d3ac78caad3d24ce315d55dee2ed22dfdc65c381e28c692a0d1e7a","observation_id":"3a404a20-ecdf-45ac-b582-ef18514d00c4","resolution":{"observed_at":"2026-06-29T17:23:44.897400Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":"2307.15818","doi":"10.48550/arxiv.2307.15818","metadata_source":"pith","pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","venue":"cs.RO","work_id":"ff438a8a-8003-4fae-9131-acd418b3597b","year":2023},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:447e7374dbf250453d01f72f554c0a081d8cec2adedef1da6a0b2f28623dd459","observation_id":"62567983-9e3c-4c23-ac22-6cb251a99e45","resolution":{"observed_at":"2026-06-29T17:23:44.913881Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:4533d00207091afe291479af468efc988bef7898c4f6d5f9f197f39a5e07edb7","observation_id":"2275bb3f-fa75-4b62-b5f1-b15249c9b085","resolution":{"observed_at":"2026-06-29T17:23:44.904879Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:9d09d18b190d67ff071ddd96c5cf69df18a5e6523ce46c1d2293ba5181935e64","observation_id":"733a7607-0446-4682-a0af-7c6f6f7f99d1","resolution":{"observed_at":"2026-06-29T17:23:44.923746Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-08-14T08:22:11.295012Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":"2405.12213","doi":"10.48550/arxiv.2405.12213","metadata_source":"pith","pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Octo: An Open-Source Generalist Robot Policy","venue":"cs.RO","work_id":"f9ca0722-8855-48c3-a27a-0eefb7e19253","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:f3b137ed72aa928f23e6b459a9cfd774bb1f64032029fbc5f10c954d1e785ecc","observation_id":"d6ff64a6-a339-428d-9bee-e2f39b9a11af","resolution":{"observed_at":"2026-06-29T17:23:44.919434Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09973","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:28:34.789725Z","title":"RoboInter: A holistic intermediate representation suite towards robotic manipulation.arXiv preprint arXiv:2602.09973, 2026","venue":null,"work_id":"fdf1d525-7b1e-4e29-b988-9358c668834c","year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:c314e5b47f16858bedc3d6bf2989fe9197d1d106e53a8c8ebeceaf4b5bed9305","observation_id":"5af2092c-fc3d-49f7-b280-3d8679e7a9bc","resolution":{"observed_at":"2026-06-29T17:23:44.953547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03409","last_updated":"2024-11-05T18:48:12Z","snapshot_observed_at":"2026-08-18T16:06:13.812210Z","submitted_at":"2024-11-05T18:48:12Z","title":"STEER: Flexible Robotic Manipulation via Dense Language Grounding","version":1},"cited_work":{"arxiv_id":"2411.03409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.03409","snapshot_observed_at":"2026-07-01T23:36:23.928998Z","title":"Steer: Flexible robotic manipulation via dense language grounding","venue":null,"work_id":"a2a82d9c-c14e-4671-b9a0-aaeeaee36eab","year":2024},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2411.03409","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:e01743708155b7786580b0726fb069dd555b4b7715f5198ea5eb7f0a211d86d6","observation_id":"5a7e1444-131a-4cc0-96ec-56dbdc4576f7","resolution":{"observed_at":"2026-06-29T17:23:44.937340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21652","last_updated":"2025-06-16T19:45:50Z","snapshot_observed_at":"2026-08-21T11:38:18.094651Z","submitted_at":"2025-05-27T18:25:42Z","title":"PartInstruct: Part-level Instruction Following for Fine-grained Robot Manipulation","version":3},"cited_work":{"arxiv_id":"2505.21652","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21652","snapshot_observed_at":"2026-06-29T17:23:44.944253Z","title":"PartInstruct: Part-level instruction following for fine- grained robot manipulation, 2025","venue":null,"work_id":"6b8d7ce5-604d-4416-b486-3599c4e74ab7","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2505.21652","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:7f29ca867d51cb2eeb017376ed9ffdbfdf85342b621c7fe65c2c9acb6bca7d5c","observation_id":"9eed3036-5fa9-433b-a62a-17c7bddfe3eb","resolution":{"observed_at":"2026-06-29T17:23:44.946075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:e104986e884aa27d1dee34af5a82838e28cd60bc971b2778f5683d7e95b4a34e","observation_id":"87a4314c-5c8e-4816-9c26-e207e941d957","resolution":{"observed_at":"2026-06-29T17:23:44.955913Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"Qwen3.5-Omni technical report, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:3117dbf127ea77bbbabb914b0b95f286f299d8a62cad16a13325c2d60c6af9ef","observation_id":"2b405af1-95bc-4f6b-861c-341cc5346d29","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18908","last_updated":"2025-03-20T17:56:05Z","snapshot_observed_at":"2026-08-20T07:55:28.713615Z","submitted_at":"2024-07-26T17:59:09Z","title":"Wolf: Dense Video Captioning with a World Summarization Framework","version":2},"cited_work":{"arxiv_id":"2407.18908","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.18908","snapshot_observed_at":"2026-06-29T17:23:44.936349Z","title":"Wolf: Dense video captioning with a world summa- rization framework","venue":null,"work_id":"822d0a44-75e9-41fa-8ff8-730426fa3bae","year":2025},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2407.18908","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:2f4079e56774ef40896e65c9697782e7c1fceaf8dcd18a54c699c3dcf648bce6","observation_id":"9f0d7d01-72f0-4063-90af-4daa7239d4d5","resolution":{"observed_at":"2026-06-29T17:23:44.937908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11736","last_updated":"2023-07-01T05:38:52Z","snapshot_observed_at":"2026-08-20T07:55:29.261139Z","submitted_at":"2022-11-21T18:56:00Z","title":"Robotic Skill Acquisition via Instruction Augmentation with Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2211.11736","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.11736","snapshot_observed_at":"2026-06-29T17:23:44.957093Z","title":"Robotic skill acquisition via instruction augmentation with vision- language models","venue":null,"work_id":"7c8db303-927e-423e-840c-3a49bd78cb52","year":2023},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"cited_paper":"/paper/2211.11736","citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:951778348412c56fd7da209ba38c15b899fcdc0aa2a84e44392f2bd99d6351b5","observation_id":"b5c370f8-4a46-49eb-a44d-496b181cd740","resolution":{"observed_at":"2026-06-29T17:23:44.958498Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"RoboAnnotatorX: A comprehensive and universal annotation framework for accurate understanding of long-horizon robot demonstration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:cbae7afb6c041af1bf9273aa346f7535bffbe75c4e58522fe3eb03fc396279ed","observation_id":"8252332d-2122-4e1b-8a4e-3e7497ff1a97","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"16 A Appendix Contents A.1 FineVLA-Tool Details","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:b89b5247f1683c24600ed85820efca4da54f2b211db1b3edd877c4ffb8268abf","observation_id":"6810bc69-ab46-4fd6-a821-07127e9cc7f8","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:c1036fb68f3aecc4bfc448678ae40b9a0102b6049f3ff2f58694efefb8a424da","observation_id":"be9629e0-c078-4c29-89f5-d04717e1289d","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:c7ef1276d92bfe1a453a457a6a52a8dda0f9f6d7639306face62be860b852faf","observation_id":"86deb8c7-0014-4790-9d1e-b8e6b51d6ec8","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:7dcdce373ca5e5ecb2bb4575a275879e340fabc636dde1af9dfff8b58b999dda","observation_id":"ca6f998f-4188-4f7c-b143-77148b98d4dc","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"Step1\":","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:f782def0ee258e750bfacbe0a652f4931a52855c242fb0c64076a971bf8bf3a6","observation_id":"8c0b8748-e75c-4c41-b8bd-0bfb07103f16","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:efa271515d349358a88f237c897b8f7fbfa6aff528368206fb88e3a245955b90","observation_id":"014cf17a-fb95-4522-a750-cce714d5e4b5","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:350dcacf2dacf9bc8b7c981fb979cd6ad4058a49385de2896229ce4ef92422fb","observation_id":"4aa96c8b-c84b-4d20-942b-c91ce50bead7","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:f38e7b5ddcc0fdd79dfc06f18f365b9f9ac00880bc21701f608eeb36f99b27e5","observation_id":"7382d66d-9a14-4473-939d-f8d17f933fb7","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:f6659ce04e6096976ef85874693ba01bc8f5d7542c514f1d7764baf620c64e40","observation_id":"885371fc-fef3-4f87-99fa-3446aeb9707b","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:b01f8de2474b13d8e9031106939023ef57ce985980325dc1f0f214e739bae231","observation_id":"ca2b34de-6f1e-4ac9-9644-eb9455c7d2e7","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:5fcd333447f53f985a56d273e16740a4c7951e86ddb0fd515cb467be6e472dbb","observation_id":"d42f5209-f7b3-45f8-b387-922d7490c546","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:932d9bed6f5a9560852492122648ec7c1191f85c5ee5e2f2baa94cefc79dab93","observation_id":"7d772460-0b99-434e-a551-d4d41b0d846f","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:32c4be50ec15fc960eee7bc417af75f43753d396f6799c3f539839d5e213f113","observation_id":"46443247-aee5-412e-b485-76deb9383c4b","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:a2b618fe429f92de1a9d6c2629dcbcb1a52ae5b4319cbe1899865461def13eb4","observation_id":"00246846-1535-4510-8c95-456146c25938","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:ff10a1c8263d485127e322d21668b819f81c5db555aa6cf31f651abb7571bea2","observation_id":"6f8bf47c-0219-4721-917f-5d4a4a2338c6","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:1a3ec192100a8f2336cbc89209a409c36f546beee89009536c1591b95f2db3f9","observation_id":"d82bea80-3a71-40df-a2a9-d9b275e8f34e","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:55a42015e52553c86d9ec011002ea791571977df7a30f592aaf05c5c4d940384","observation_id":"9011210b-eb83-44fc-8d11-d49920987b57","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":"all/none of the above","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:1b4c8092931879b5cb4def6d57ecfe7781492ff4ea92bb14272c190aa095b1a8","observation_id":"11b58061-772b-4d96-8494-1666cac46438","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:f9d16010239b8b2f3c681dca536fa9bc82d83a1788ec423a4bcacd85b78ae23e","observation_id":"1c685995-ba6c-4b5c-b313-85326ad0f960","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:19:04.477325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-29T17:19:04.477325Z"},"links":{"citing_paper":"/paper/2605.27284"},"observation_digest":"sha256:15473899453ea89d5d3bcb9860bdf476dd93ac4876e2598b07cdbcb343d9bca6","observation_id":"42313c12-6e06-46ff-b05b-31b9614d66bc","resolution":{"observed_at":"2026-06-29T17:19:04.477325Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.27284","last_updated":"2026-05-26T17:01:10Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T12:22:02.585549Z","submitted_at":"2026-05-26T17:01:10Z","title":"FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":27,"verified_exact":25,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2605.27284."}