{"as_of":"2026-08-20T17:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f41c35b9df037987e300bc8da64036c90e0c3ec2b17945236d7a243749e253e0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:00:47.944965Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T13:37:06.851753Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-08T11:25:49.209337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07949","last_updated":"2025-05-20T19:54:36Z","snapshot_observed_at":"2026-08-16T15:58:25.153980Z","submitted_at":"2025-02-11T20:57:46Z","title":"Advancing Autonomous VLM Agents via Variational Subgoal-Conditioned Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T11:25:49.209337Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2502.07949"},"observation_digest":"sha256:aef3a781ba30b483fe1048eea0dde033746f4bb27cc81cede54bbb719de2048d","observation_id":"61a16baa-4b4f-4967-91f0-ffe0c112cd86","resolution":{"observed_at":"2026-08-08T11:25:49.209337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-08T00:03:16.429020Z","title":"Guiding long-horizon task and motion planning with vision lan- guage models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08643","last_updated":"2025-02-18T16:45:59Z","snapshot_observed_at":"2026-08-12T11:17:44.563445Z","submitted_at":"2025-02-12T18:57:22Z","title":"A Real-to-Sim-to-Real Approach to Robotic Manipulation with VLM-Generated Iterative Keypoint Rewards","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T00:03:16.429020Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2502.08643"},"observation_digest":"sha256:5f6637f978216c0b6cb8eac052632e0982bf66589c72b00ea951404f2ba38cae","observation_id":"2efc599c-5a43-49c0-8a75-ce0d06ab43bd","resolution":{"observed_at":"2026-08-08T00:03:16.429020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-15T22:00:47.944965Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08444","last_updated":"2025-08-07T07:11:32Z","snapshot_observed_at":"2026-08-18T20:21:29.397362Z","submitted_at":"2025-05-13T11:13:00Z","title":"Extracting Visual Plans from Unlabeled Videos via Symbolic Guidance","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T22:00:47.944965Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2505.08444"},"observation_digest":"sha256:d034405209aacc485f958809d080906adc9cf17ab2807e252b2b7272bd0a7df1","observation_id":"2dac3aec-562b-41ed-90f0-9a549a55924e","resolution":{"observed_at":"2026-08-15T22:00:47.944965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-07T12:42:27.331223Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24073","last_updated":"2025-08-26T16:42:37Z","snapshot_observed_at":"2026-08-17T13:14:58.451971Z","submitted_at":"2025-05-29T23:32:03Z","title":"mRAG: Elucidating the Design Space of Multi-modal Retrieval-Augmented Generation","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:42:27.331223Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2505.24073"},"observation_digest":"sha256:05dc0b9c6b390cf69104a8a3e51d19b4dd5074014e7df090cf1e47bdafe40be0","observation_id":"c1848118-e483-463a-ab21-716fe7f947e7","resolution":{"observed_at":"2026-08-07T12:42:27.331223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-07T12:11:53.248800Z","title":"Guiding long-horizon task and motion planning with vision language models.arXiv preprint arXiv:2410.02193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00411","last_updated":"2025-05-31T06:01:03Z","snapshot_observed_at":"2026-08-17T18:31:50.392129Z","submitted_at":"2025-05-31T06:01:03Z","title":"LoHoVLA: A Unified Vision-Language-Action Model for Long-Horizon Embodied Tasks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:53.248800Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2506.00411"},"observation_digest":"sha256:4f62e658fc8d986fa37b25563daba3f757e70479902e0246cbb4249d406c509d","observation_id":"1dadc5fd-e2b5-4f32-a48f-cc3b5ba8e226","resolution":{"observed_at":"2026-08-07T12:11:53.248800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-06T23:12:03.390138Z","title":"Guiding long-horizon task and motion planning with vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19498","last_updated":"2025-06-24T10:36:15Z","snapshot_observed_at":"2026-08-16T19:03:05.720328Z","submitted_at":"2025-06-24T10:36:15Z","title":"T-Rex: Task-Adaptive Spatial Representation Extraction for Robotic Manipulation with Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:03.390138Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2506.19498"},"observation_digest":"sha256:fce695a75e31f18f8b44d8036eb1a41bceaa17b6f7ab208e90a7495da2a48621","observation_id":"976c396b-5b79-49c7-92ee-e309c1a1840f","resolution":{"observed_at":"2026-08-06T23:12:03.390138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-15T18:33:40.598576Z","title":"Guiding long-horizon task and motion planning with vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21627","last_updated":"2025-06-24T14:11:22Z","snapshot_observed_at":"2026-08-16T12:04:29.320693Z","submitted_at":"2025-06-24T14:11:22Z","title":"FrankenBot: Brain-Morphic Modular Orchestration for Robotic Manipulation with Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:33:40.598576Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2506.21627"},"observation_digest":"sha256:2a4242d4b2e0fad41b7acc790766db9ef68e2baf730010410df6a7d12af67a56","observation_id":"f2fb0ea0-2ead-49a1-8222-826997721c3c","resolution":{"observed_at":"2026-08-15T18:33:40.598576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-06T19:37:20.657019Z","title":"Guiding long-horizon task and motion planning with vision language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05118","last_updated":"2025-07-07T15:31:36Z","snapshot_observed_at":"2026-08-20T08:02:59.240791Z","submitted_at":"2025-07-07T15:31:36Z","title":"VerifyLLM: LLM-Based Pre-Execution Task Plan Verification for Robots","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:37:20.657019Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2507.05118"},"observation_digest":"sha256:d6e278167711afa9618bc844e1cf411d47dc5277684799806ffb5e0eb596d865","observation_id":"ee1a5354-ac6c-4700-a473-840d19c3188d","resolution":{"observed_at":"2026-08-06T19:37:20.657019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-06T18:30:47.277176Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08224","last_updated":"2025-07-20T05:22:14Z","snapshot_observed_at":"2026-08-16T12:56:11.041115Z","submitted_at":"2025-07-11T00:17:08Z","title":"Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T18:30:47.277176Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2507.08224"},"observation_digest":"sha256:df1ffe21e1f23168692a375e496a020001a19f7c01886c6902daf87f7988532e","observation_id":"0c778abe-7d16-4f93-9d89-93e923a2a1c9","resolution":{"observed_at":"2026-08-06T18:30:47.277176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-15T16:58:33.886185Z","title":"Guiding long-horizon task and motion planning with vision language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18627","last_updated":"2025-08-26T03:08:54Z","snapshot_observed_at":"2026-08-15T16:52:36.306158Z","submitted_at":"2025-08-26T03:08:54Z","title":"Integration of Robot and Scene Kinematics for Sequential Mobile Manipulation Planning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T16:58:33.886185Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2508.18627"},"observation_digest":"sha256:5ccbb97260d5bc2b1dbfc68aae1cf211fbb028e6151a98118e1606bf69725212","observation_id":"fa6b4b45-fca7-4c04-b7ac-71805c3a68b6","resolution":{"observed_at":"2026-08-15T16:58:33.886185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-05T12:59:11.689386Z","title":"Guiding long-horizon task and motion planning with vision language models.arXiv preprint arXiv:2410.02193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01106","last_updated":"2025-09-11T12:40:54Z","snapshot_observed_at":"2026-08-12T20:25:08.144001Z","submitted_at":"2025-09-01T03:53:47Z","title":"Robix: A Unified Model for Robot Interaction, Reasoning and Planning","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T12:59:11.689386Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2509.01106"},"observation_digest":"sha256:8c575f943cd735f19bc63fde60af387989bd7a0ef1eea8fafd08090e41d58822","observation_id":"a9cb9800-7ff5-4f6c-b124-748e3bb55792","resolution":{"observed_at":"2026-08-05T12:59:11.689386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-15T16:09:09.476780Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08757","last_updated":"2025-09-10T16:47:00Z","snapshot_observed_at":"2026-08-19T17:18:57.999781Z","submitted_at":"2025-09-10T16:47:00Z","title":"SocialNav-SUB: Benchmarking VLMs for Scene Understanding in Social Robot Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:09:09.476780Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2509.08757"},"observation_digest":"sha256:784f5e425801964acd0be4d757bb5693b1190b888b28641dd382be43c7654934","observation_id":"601d362f-0b3e-4ad0-8332-2785e10d9e4f","resolution":{"observed_at":"2026-08-15T16:09:09.476780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-02T18:31:45.391393Z","title":"Guiding long- horizon task and motion planning with vision language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.09971","last_updated":"2026-07-28T19:12:58Z","snapshot_observed_at":"2026-08-20T00:54:28.795732Z","submitted_at":"2026-03-10T17:59:00Z","title":"TiPToP: A Modular Open-Vocabulary Robot Manipulation System That Plans","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T18:31:45.391393Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2603.09971"},"observation_digest":"sha256:e84239a2da39f78c5d35dc2f2d5cbced62f219b786b892292e873aa4b09fb301","observation_id":"e2b4e1a7-128e-45f4-b2a6-b6b785f8c9db","resolution":{"observed_at":"2026-08-02T18:31:45.391393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":"2410.02193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-07-10T13:37:06.851753Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","venue":"cs.RO","work_id":"cc17e5c3-48bd-451a-88af-ed51c8c52493","year":2024},"citing_paper":{"arxiv_id":"2606.07723","last_updated":"2026-06-05T16:21:27Z","snapshot_observed_at":"2026-08-02T03:37:35.733251Z","submitted_at":"2026-06-05T16:21:27Z","title":"VoLo: A Physical Orchestrator for Open-Vocabulary Long-Horizon Manipulation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T21:40:00.330510Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2606.07723"},"observation_digest":"sha256:ef4498f75bae6fd874a2e546fd488857b4f7e580b73cfe0fac3c0704fbe37120","observation_id":"1b59850b-f2f8-4c94-921c-17b87d3cce54","resolution":{"observed_at":"2026-07-02T19:07:18.128816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":"2410.02193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-07-10T13:37:06.851753Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","venue":"cs.RO","work_id":"cc17e5c3-48bd-451a-88af-ed51c8c52493","year":2024},"citing_paper":{"arxiv_id":"2606.18646","last_updated":"2026-06-17T03:31:43Z","snapshot_observed_at":"2026-08-14T11:44:44.785177Z","submitted_at":"2026-06-17T03:31:43Z","title":"A Scalable Embodied Intelligence Platform for Seamless Real-to-Sim-to-Real Transfer of Household Mobile Manipulation Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T21:01:11.683635Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2606.18646"},"observation_digest":"sha256:1ba6e1a8d5ca9a2f9c7d0fd1a13babd7503b2f5541e9be5b2a8523476e310398","observation_id":"0aa89651-974a-446e-b17c-4c792ef44b37","resolution":{"observed_at":"2026-07-04T00:39:17.619200Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":"2410.02193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-07-10T13:37:06.851753Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","venue":"cs.RO","work_id":"cc17e5c3-48bd-451a-88af-ed51c8c52493","year":2024},"citing_paper":{"arxiv_id":"2607.08024","last_updated":"2026-07-09T01:02:35Z","snapshot_observed_at":"2026-08-16T01:36:27.382056Z","submitted_at":"2026-07-09T01:02:35Z","title":"APIVOT: Adaptive Planning with Interleaved Vision-Language Thoughts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T13:33:17.574108Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2607.08024"},"observation_digest":"sha256:7963b41ab06bc448ab368fb11b7348b09143ee27a240342adff5abffc3fa0d81","observation_id":"e39b477d-af21-431b-b9e6-24738d0c90a7","resolution":{"observed_at":"2026-07-10T13:37:06.852992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02193","snapshot_observed_at":"2026-08-01T12:14:51.654139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19633","last_updated":"2026-07-22T00:05:00Z","snapshot_observed_at":"2026-08-13T02:23:00.610398Z","submitted_at":"2026-07-22T00:05:00Z","title":"LENS: LLM-guided Environment Simplification for Planning and Control in Clutter","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T12:14:51.654139Z"},"links":{"cited_paper":"/paper/2410.02193","citing_paper":"/paper/2607.19633"},"observation_digest":"sha256:7677032982761241f2ff23b1d7ec0f97d20f82169a53de7b0630a5cbdc2778f8","observation_id":"846d884b-ad99-4886-b2fd-e8e87c9fc753","resolution":{"observed_at":"2026-08-01T12:14:51.654139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.02193/citation-record","integrity":"/paper/2410.02193/integrity","json":"/paper/2410.02193/citation-record.json","paper":"/paper/2410.02193"},"outbound":[],"paper":{"arxiv_id":"2410.02193","last_updated":"2024-10-03T04:14:21Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-18T20:44:38.423700Z","submitted_at":"2024-10-03T04:14:21Z","title":"Guiding Long-Horizon Task and Motion Planning with Vision Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2410.02193."}