{"as_of":"2026-08-07T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8ffc711fd038151cb61265d70d8d93e3f665542c5ba4cd81187b4b7c48b78418","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:30:47.314225Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T17:54:50.325820Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-14T17:57:33.271111Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"cited_work":{"arxiv_id":"2507.08224","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08224","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2507.08224 , year=","venue":null,"work_id":"1d066aeb-3390-48ab-a841-7122bd6793f3","year":null},"citing_paper":{"arxiv_id":"2605.13775","last_updated":"2026-05-13T16:54:36Z","snapshot_observed_at":"2026-07-06T23:25:16.229144Z","submitted_at":"2026-05-13T16:54:36Z","title":"RoboEvolve: Co-Evolving Planner-Simulator for Robotic Manipulation with Limited Data","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-14T17:54:50.325820Z"},"links":{"cited_paper":"/paper/2507.08224","citing_paper":"/paper/2605.13775"},"observation_digest":"sha256:9ebe1679d575afaaf0093c7ad232aeebc35af7d1beeaf18d69903b6c0bcc0df7","observation_id":"c364e9b7-cc27-47fb-a46e-7f608c8ee313","resolution":{"observed_at":"2026-05-14T17:57:33.273790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08224/citation-record","integrity":"/paper/2507.08224/integrity","json":"/paper/2507.08224/citation-record.json","paper":"/paper/2507.08224"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:46.980505Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:46.980505Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:aaaa96f8a0dc11d32c58138cc54dd358370eb20a9d6d601087cb9e7ac46baeaa","observation_id":"fb0dd182-f850-4094-bb1f-496caffbf2e7","resolution":{"observed_at":"2026-08-06T18:30:46.980505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:46.987966Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:46.987966Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:9e8da467ce02f026c4d770574acece186cc28ede8f0d7add7aaec3fc7ff3fae4","observation_id":"74f1bc55-06f1-47e9-9bd3-372b40eab221","resolution":{"observed_at":"2026-08-06T18:30:46.987966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06851","last_updated":"2025-06-02T14:38:08Z","snapshot_observed_at":"2026-07-06T20:34:15.946558Z","submitted_at":"2025-02-07T11:56:46Z","title":"Survey on Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06851","snapshot_observed_at":"2026-08-06T18:30:46.995093Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:46.995093Z"},"links":{"cited_paper":"/paper/2502.06851","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:278ba616914a572810901c5b378604f581a913b05a1d2ed909c8821c8a9a4f56","observation_id":"e7e8e019-35c2-44fc-ba5f-8694c143d54f","resolution":{"observed_at":"2026-08-06T18:30:46.995093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.723892Z","title":null,"venue":null,"work_id":"3f63813e-6a44-4b18-989f-54991d499f82","year":2022},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.006552Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:8487d6c05b704b7a8d4f1526130314da212ece2aa85263944b96f4cf8fa0dcf6","observation_id":"f6dca45c-b44a-40c2-93ab-a036b2e7e267","resolution":{"observed_at":"2026-08-06T18:30:48.730230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T18:30:47.012122Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.012122Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:807ac1e3eea00d6b311ed3cd509fd2abe99be2a9575ddd075c7770d5872a4622","observation_id":"3c2f8101-5a62-4572-b2e7-1a47856d4ce5","resolution":{"observed_at":"2026-08-06T18:30:47.012122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-05T10:06:10.880743Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-06T18:30:47.018175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.018175Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:ecedcaad3b0264c6650f6995bf8584be6269c0ee9c9b63725e2d0392fdcd13c8","observation_id":"0472de09-b102-4441-8ea1-7c0ad0ba75b1","resolution":{"observed_at":"2026-08-06T18:30:47.018175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19472","last_updated":"2024-09-18T15:30:33Z","snapshot_observed_at":"2026-08-07T13:35:52.575760Z","submitted_at":"2023-05-31T00:55:40Z","title":"PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning","version":3},"cited_work":{"arxiv_id":"2305.19472","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.19472","snapshot_observed_at":"2026-08-06T18:30:48.332624Z","title":"PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning","venue":"cs.CL","work_id":"f81cbaf4-191e-4fe0-9147-3c24b8fd859d","year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.023726Z"},"links":{"cited_paper":"/paper/2305.19472","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:aaa6ac6e1ed6e6466b043fd13949b2460858e5537ae372b9d78e61154211acd1","observation_id":"a2f43f9f-75e7-4290-9673-93d06c3322e2","resolution":{"observed_at":"2026-08-06T18:30:48.338796Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.698354Z","title":"Brennan and Dale J","venue":null,"work_id":"f8fcda47-b228-40d0-b07d-3eb26904352d","year":1981},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.030438Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:3718d2d553d8af0b70a7ce3b28ab4703d330a0d94d5eef4fb220fa84be269abb","observation_id":"a920fc33-b801-484e-b056-d7ceb811836a","resolution":{"observed_at":"2026-08-06T18:30:48.710161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03966","last_updated":"2024-09-06T01:29:35Z","snapshot_observed_at":"2026-07-06T19:11:18.410415Z","submitted_at":"2024-09-06T01:29:35Z","title":"Automating Robot Failure Recovery Using Vision-Language Models With Optimized Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03966","snapshot_observed_at":"2026-08-06T18:30:47.036931Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.036931Z"},"links":{"cited_paper":"/paper/2409.03966","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:8c8271135c778f7095d4a92a5c46e44cfdf0e071624c2762be5289083cc878b5","observation_id":"13fdbfae-22c3-40d4-b465-557026c58a59","resolution":{"observed_at":"2026-08-06T18:30:47.036931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-03T17:33:16.283221Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-08-06T18:30:47.046180Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.046180Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:e37dd5313940e4cd64d056989b5c0756391a2d7520182b7d8727887c752be90e","observation_id":"74ba35c4-3fda-4de6-8faf-1e5eeae78498","resolution":{"observed_at":"2026-08-06T18:30:47.046180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00855","last_updated":"2024-10-30T14:45:00Z","snapshot_observed_at":"2026-08-07T12:15:46.504578Z","submitted_at":"2024-10-30T14:45:00Z","title":"Vision-Language Models Can Self-Improve Reasoning via Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00855","snapshot_observed_at":"2026-08-06T18:30:47.053859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.053859Z"},"links":{"cited_paper":"/paper/2411.00855","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:efb858a0d8c4a4fb530f5265accdb0a75b3d17a9f7c7e572e9785f613ecf4065","observation_id":"45b7c3e9-47bb-4b4e-a65a-4055516ca53a","resolution":{"observed_at":"2026-08-06T18:30:47.053859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.674858Z","title":null,"venue":null,"work_id":"0b429bbb-bbde-402b-9e3d-173b279d33c8","year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.066037Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:c205d90dcf1d7b8c145fee2094fdf9ef82a4b1392f8639e4534bddd29daf98ac","observation_id":"75d61194-db29-4578-ba53-c4674dcff9cc","resolution":{"observed_at":"2026-08-06T18:30:48.684806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-06T18:30:47.071366Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.071366Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:c1c2931ee64f3b11aabd6099e8e86f3082d3e25169490b179dae3e4decb666aa","observation_id":"a28be9da-70ee-4ce0-99e6-6b2bda0e64e2","resolution":{"observed_at":"2026-08-06T18:30:47.071366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17453","last_updated":"2024-10-31T23:23:22Z","snapshot_observed_at":"2026-07-06T18:51:23.832577Z","submitted_at":"2024-07-24T17:37:05Z","title":"VILA$^2$: VILA Augmented VILA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17453","snapshot_observed_at":"2026-08-06T18:30:47.078101Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.078101Z"},"links":{"cited_paper":"/paper/2407.17453","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:6f3290e28a4721d19bf82672409ec6f0d94fd8c6c485fe2d64a419849c651790","observation_id":"499834a9-0b1d-42ec-9a04-21622fb379df","resolution":{"observed_at":"2026-08-06T18:30:47.078101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.649792Z","title":null,"venue":null,"work_id":"0852cbf7-94b3-438c-8489-3fb1548a8b00","year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.083418Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:b703ccc8fccda428ab6bd03f876d5e872e67631bccc55cdbfecb85b82b9cdde9","observation_id":"42787510-6f87-4ece-a624-67497408a71d","resolution":{"observed_at":"2026-08-06T18:30:48.655461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08998","snapshot_observed_at":"2026-08-06T18:30:47.087978Z","title":"Doucet, Orhan Firat, and Nando de Freitas","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.087978Z"},"links":{"cited_paper":"/paper/2308.08998","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:24836404df00ea8d61848cffa3a5c3f75dc203c9e21e04c1a9f2f641bedf8ac3","observation_id":"1ca04d29-1942-4306-846f-44e8fb5ad42b","resolution":{"observed_at":"2026-08-06T18:30:47.087978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.093465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.093465Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:04eb8e7de43b3a279654deedad0c7f5cae1f80a0090a5bc2aa0e11d897c36c5a","observation_id":"f2a4f9b9-c33e-4ae6-9d16-7e2f5a538443","resolution":{"observed_at":"2026-08-06T18:30:47.093465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"biblio/1036629","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.196404Z","title":"https://par.nsf.gov/biblio/10366294 Language models as zero-shot planners: Extracting actionable knowledge for embodied agents","venue":null,"work_id":"5a034843-c402-465f-b628-15095171e718","year":null},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.099829Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:6fe9816622479776359a139099229e348c2a6fa9bd0bfaf4ce5f55d667c1360f","observation_id":"b6242b2c-a110-4270-89bb-642ec11acaec","resolution":{"observed_at":"2026-08-06T18:30:48.207348Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-06T18:30:47.107836Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.107836Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:8c5371d8e02979c06e68e74a170403bac5337e71e88dcedc3a022adf13f011b8","observation_id":"25c444b0-2a70-43be-923e-1f5079aafd1b","resolution":{"observed_at":"2026-08-06T18:30:47.107836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02716","last_updated":"2024-02-05T04:25:24Z","snapshot_observed_at":"2026-07-06T17:25:14.115360Z","submitted_at":"2024-02-05T04:25:24Z","title":"Understanding the planning of LLM agents: A survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02716","snapshot_observed_at":"2026-08-06T18:30:47.115698Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.115698Z"},"links":{"cited_paper":"/paper/2402.02716","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:2a1f1da5cd9295a81fc73ca92677e8416565e52d3d4b854393a9546d476c9ad1","observation_id":"3fcbe79a-d35a-43ea-a474-e5869def3464","resolution":{"observed_at":"2026-08-06T18:30:47.115698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.629121Z","title":null,"venue":null,"work_id":"f98816ca-e16c-4c48-944a-e1378d094101","year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.123890Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:e751956285bb1464b155f88037b19012833ad58ab5a582a86870ab68307b617f","observation_id":"d67742a5-414e-44d7-946e-be19d36af43c","resolution":{"observed_at":"2026-08-06T18:30:48.635814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.130350Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.130350Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:6d59b606806ce02873b1cdd5f87efef48acb1dd579ae3fdc790d378f4fc07ece","observation_id":"b61d8037-895e-4eb9-9c95-c141de593fd6","resolution":{"observed_at":"2026-08-06T18:30:47.130350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.608025Z","title":null,"venue":null,"work_id":"f7b5e474-0714-4f46-b21c-ad9f97354710","year":2022},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.135580Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:dca03e50c11737bd17add89042b7b26a80df1b04dc0f75af2bd0b04c552f549b","observation_id":"52c8339f-f7fd-493a-9f7c-513ff24f4407","resolution":{"observed_at":"2026-08-06T18:30:48.615454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-08-06T18:30:47.141916Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.141916Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:b885b73529266ff5c376f85e6e20a47961a20f07dcb124dd7d09bec3b8d777b4","observation_id":"6ff68727-e227-4c83-bb33-1000029dd7d5","resolution":{"observed_at":"2026-08-06T18:30:47.141916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.588741Z","title":null,"venue":null,"work_id":"c940a436-7465-402c-9402-6ec552701ce1","year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.147926Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:ca9678cc8558b96cea13daaeb8e8ab6d1eea9199e7a9a5010c4e3548a7230490","observation_id":"8f298308-be75-4cc4-a275-1b12116abd05","resolution":{"observed_at":"2026-08-06T18:30:48.595698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.152976Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.152976Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:563a66ee92a43e9dc06065e4496662587742b43cb71c7ac34e9499e8323af73d","observation_id":"ef66c3e3-014b-4f34-9cf6-00b2bb853fa4","resolution":{"observed_at":"2026-08-06T18:30:47.152976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.567348Z","title":null,"venue":null,"work_id":"c6402969-5600-4966-913f-e08128a467c4","year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.162836Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:18db63fd8269b7f15ef28464f4a586e9bdd43e9619464bde613286f8c17597ab","observation_id":"d238970b-e0bd-4ca2-bb70-0782595ce78d","resolution":{"observed_at":"2026-08-06T18:30:48.573110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-06T18:30:47.171085Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.171085Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:9322bb5dc26a21f41e2984fda2e24e1cb17685b0cab843b5422edc5ec91be551","observation_id":"238becbf-770f-4e79-805e-082cacf55dae","resolution":{"observed_at":"2026-08-06T18:30:47.171085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01795","last_updated":"2023-05-02T21:46:44Z","snapshot_observed_at":"2026-08-03T23:35:46.475935Z","submitted_at":"2023-05-02T21:46:44Z","title":"Multimodal Procedural Planning via Dual Text-Image Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01795","snapshot_observed_at":"2026-08-06T18:30:47.177417Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.177417Z"},"links":{"cited_paper":"/paper/2305.01795","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:e8a1b569d34eda2a07c64e7f05c40b985dbd601a7b5d77a47b1010ccd28462fb","observation_id":"95dc4e28-f74a-4ed7-a129-993b44200739","resolution":{"observed_at":"2026-08-06T18:30:47.177417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.183328Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.183328Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:5508d53b925d0020cf077e5d8514bf93625f574d1845057a741fa32286b3439a","observation_id":"00f0d8eb-bd10-4330-bcca-afd863200ec7","resolution":{"observed_at":"2026-08-06T18:30:47.183328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.189516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.189516Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:da7e15fec462fdb34470b8006d413b14afb1644d901ca2fad4d145094317fd27","observation_id":"2b36099c-36df-4478-abe5-d8f0cd94046f","resolution":{"observed_at":"2026-08-06T18:30:47.189516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T18:30:47.198815Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.198815Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:6f921e75ab8ae27af126bee96800885cb4d756701f55a1f79bc24b3100e00886","observation_id":"eeb0acda-8021-41bb-9f02-32e953ae2f6b","resolution":{"observed_at":"2026-08-06T18:30:47.198815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.529174Z","title":null,"venue":null,"work_id":"945a7715-83bc-49f0-bdca-b3fbd2c9cf5f","year":2018},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.204376Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:b671ec935e23e73539b6c58fa8a8717468eff3577ea220a88d079d4f133926bb","observation_id":"19e30561-78cd-47bc-aa84-b49210767281","resolution":{"observed_at":"2026-08-06T18:30:48.537264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19417","last_updated":"2025-07-15T17:44:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T18:58:41Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19417","snapshot_observed_at":"2026-08-06T18:30:47.209392Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.209392Z"},"links":{"cited_paper":"/paper/2502.19417","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:02403aa501c32be8ffc4e53905e620647817c8f63e698df89a2941c60db04bac","observation_id":"f797af11-a89a-4d06-85f5-1d65d71a36a1","resolution":{"observed_at":"2026-08-06T18:30:47.209392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.507275Z","title":"Sadler, Wei-Lun Chao, and Yu Su","venue":null,"work_id":"afde7d95-4f0d-4d3f-aea6-a858b3e14970","year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.216940Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:26e2b145cb3c4932c13f801f75c00c82c236d6466ed1b3786deb0341a6dd905b","observation_id":"8f5a2e0c-e659-4af8-9b90-1f7f0c9a26f1","resolution":{"observed_at":"2026-08-06T18:30:48.513131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.485874Z","title":null,"venue":null,"work_id":"c5995172-f103-4636-813b-b4c67eef0e94","year":2022},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.222760Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:dcd457f5b5cd356cefa0f62b4b8754d4d618eeadc498105162715a0eb6b22aca","observation_id":"8eb0a301-aa7d-4f48-a8ad-91bb3b327c97","resolution":{"observed_at":"2026-08-06T18:30:48.492218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.465957Z","title":null,"venue":null,"work_id":"1f0b0786-9477-4206-9d95-ee6bafef8c73","year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.228130Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:d25332c6a88293e18b1eef1be9b96ae084cdaf45f7b39b049718c0b0a2584bf4","observation_id":"7b6deb97-8216-4015-aa49-a5279331725e","resolution":{"observed_at":"2026-08-06T18:30:48.472055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T18:30:47.234928Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.234928Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:fb806b11ee965b05f3f96603f4e35b8546334e545603a6da9676693f90397d43","observation_id":"b9aaecb6-f2b8-419b-b9dc-919e445ec3ca","resolution":{"observed_at":"2026-08-06T18:30:47.234928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.240253Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.240253Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:ab0514146c36e14d53f6eaf3fdee15fb8fed6fe78690240c443f12c172492015","observation_id":"1c520921-5056-493a-8742-d540e41b26f5","resolution":{"observed_at":"2026-08-06T18:30:47.240253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01754","last_updated":"2025-03-19T18:35:44Z","snapshot_observed_at":"2026-08-07T17:32:58.635348Z","submitted_at":"2025-03-03T17:24:42Z","title":"SDRT: Enhance Vision-Language Models by Self-Distillation with Diverse Reasoning Traces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01754","snapshot_observed_at":"2026-08-06T18:30:47.244957Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.244957Z"},"links":{"cited_paper":"/paper/2503.01754","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:58d9c10b8a2e43d5e122609e09848faa3d210bdafbfba681c14a7d987fc3f8be","observation_id":"b9caf3de-9965-42bd-a44c-2c383235fad5","resolution":{"observed_at":"2026-08-06T18:30:47.244957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-08-06T18:30:47.251015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.251015Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:70e35d4d6f2d21e712a831aaeb8fa52679e916691539f92e156136f6cb3835e4","observation_id":"9615e3cf-cb0d-45df-8835-0d74c2c1830c","resolution":{"observed_at":"2026-08-06T18:30:47.251015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.444468Z","title":null,"venue":null,"work_id":"224f72ce-cfee-4a70-a10c-1f7a8a0f8266","year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.255811Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:34a2c71a10d9d9bd5582574510c33937b7d71518de5bf1586b84c1babd1d8183","observation_id":"a4ef2110-f1b6-417e-92f5-761591658128","resolution":{"observed_at":"2026-08-06T18:30:48.451577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-06T18:30:47.260464Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.260464Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:2b87cc2018560c9843f81de6e13be7123b2ebdeea86dc85b964c07162129fcf3","observation_id":"eca536b6-ff76-4636-ace4-68c41de60ebc","resolution":{"observed_at":"2026-08-06T18:30:47.260464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12950","last_updated":"2024-03-16T04:22:09Z","snapshot_observed_at":"2026-07-06T15:57:57.167169Z","submitted_at":"2023-07-24T17:23:22Z","title":"RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12950","snapshot_observed_at":"2026-08-06T18:30:47.265500Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.265500Z"},"links":{"cited_paper":"/paper/2307.12950","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:d87ac7db7dd7c2cf0c100cd0ef5f10e385fde2637f69dcc21921acbefe07cab4","observation_id":"4159dc25-b6e1-4d9a-8ace-106e05b18e14","resolution":{"observed_at":"2026-08-06T18:30:47.265500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11381","last_updated":"2023-03-20T18:31:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-20T18:31:47Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11381","snapshot_observed_at":"2026-08-06T18:30:47.270558Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.270558Z"},"links":{"cited_paper":"/paper/2303.11381","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:a34c7dc514aa067786f3f395e3baa440ab987800ff8357a03ece27e3491ace45","observation_id":"7bcf115f-3e47-4882-a3e7-5fcdd70cabcb","resolution":{"observed_at":"2026-08-06T18:30:47.270558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-06T03:27:47.616528Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-06T18:30:47.277176Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.277176Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:88d117dbbc9dfe565293d9a7a73c8d6117b187b721eff11d471cc35ff1c21685","observation_id":"0c778abe-7d16-4f93-9d89-93e923a2a1c9","resolution":{"observed_at":"2026-08-06T18:30:47.277176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"biblio/1045146","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.716889Z","title":"https://par.nsf.gov/biblio/10451467 React: Synergizing reasoning and acting in language models","venue":null,"work_id":"b4dc73c3-b72d-4215-b4f0-3c6076ea8526","year":null},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.281489Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:073656681e03e917d2f8a7e2a3bc65df2035a4417a8d47c92f31a87d6b06e4bb","observation_id":"85746b45-0d14-401e-b1eb-556c21a63ca7","resolution":{"observed_at":"2026-08-06T18:30:47.727301Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-long.287","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.386611Z","title":null,"venue":null,"work_id":"e428c521-b1b5-4776-89bc-c23d03073e1d","year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.286320Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:4bfa2dd2ccd0011c84479284f04b498b90f1f0e72d241aa2c24ec38def767ade","observation_id":"19e20e32-4c62-4415-8e98-3f0612013e31","resolution":{"observed_at":"2026-08-06T18:30:47.392093Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.424274Z","title":null,"venue":null,"work_id":"b173670b-a2bf-43bd-a817-692f84c83f44","year":2020},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.291442Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:30288324827e5cdf39ff3b07ee047a7fdf2a7ed52a747bfa9ead36303e5a15d2","observation_id":"fe49557f-e32c-47ae-8ccb-cab4b6594058","resolution":{"observed_at":"2026-08-06T18:30:48.431477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05047","last_updated":"2024-10-07T14:05:05Z","snapshot_observed_at":"2026-07-06T18:42:22.322763Z","submitted_at":"2024-07-06T11:07:18Z","title":"MFE-ETP: A Comprehensive Evaluation Benchmark for Multi-modal Foundation Models on Embodied Task Planning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05047","snapshot_observed_at":"2026-08-06T18:30:47.297006Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.297006Z"},"links":{"cited_paper":"/paper/2407.05047","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:3867bc91bb6873474f3aaa087ade99164f5571b26b9c27b910bb4ab4030ab856","observation_id":"ffe80c4a-9cbe-46a0-928f-bbf1bbccbf3f","resolution":{"observed_at":"2026-08-06T18:30:47.297006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:47.303399Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.303399Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:2f5fc4ad30f9bad7f6624d4045221ea01de2cb1d7ad12239b33734f078da2a53","observation_id":"9575fda0-2966-4560-a7ed-0d1109c5038e","resolution":{"observed_at":"2026-08-06T18:30:47.303399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:30:48.395643Z","title":null,"venue":null,"work_id":"0241c84c-f59f-4cc5-b206-327b0fe7f333","year":2017},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.308608Z"},"links":{"citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:759c3381bb5c6eeb468f44fe9bc5a124e676363c25d402f7acd256c17b2f4553","observation_id":"6d83ac0c-a603-4300-83a9-7efde7a4301c","resolution":{"observed_at":"2026-08-06T18:30:48.400750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T18:30:47.314225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.314225Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:464bd2fabce9dd3967fd46ff223511771faa0b96be83fb9ae0fa4ad193ab093d","observation_id":"db7e958e-58be-4b73-961c-a52c603863ad","resolution":{"observed_at":"2026-08-06T18:30:47.314225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T18:21:12.044757Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":47,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2507.08224."}