{"as_of":"2026-08-07T18:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2bca1154b99c097198bc8bc77b53d11ca7602f54c9e3aa02d70673e4884ce029","coverage":[{"denominator":107,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:17:13.536817Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T06:18:55.493101Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T05:07:18.165010Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"cited_work":{"arxiv_id":"2506.10966","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10966","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GenManip: LLM-driven simulation for generalizable instruction-following manipulation","venue":null,"work_id":"43fe298b-8e93-49ee-8208-e9a4bc059400","year":2025},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":239,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/2506.10966","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:9ff3a3ab5fb58ad3dc6b061bd9f985537f6b2bc761807d1c2f7b1644e4619679","observation_id":"ae9a638b-a8ec-48e6-af85-d3d2c2808645","resolution":{"observed_at":"2026-05-13T05:07:18.166697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10966","snapshot_observed_at":"2026-07-31T06:18:55.493101Z","title":"GENMANIP: LLM-driven simulation for generalizable instruction-following manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24744","last_updated":"2026-07-27T17:59:58Z","snapshot_observed_at":"2026-08-06T17:57:37.442251Z","submitted_at":"2026-07-27T17:59:58Z","title":"Data Pyramid for Embodied Manipulation","version":1},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-07-31T06:18:55.493101Z"},"links":{"cited_paper":"/paper/2506.10966","citing_paper":"/paper/2607.24744"},"observation_digest":"sha256:59afbc7536c69170c8047858d2d7103bcaa53fc934a98054224b2015e230c2a9","observation_id":"cb854878-da0f-4c31-a11e-b13e85eefffa","resolution":{"observed_at":"2026-07-31T06:18:55.493101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10966/citation-record","integrity":"/paper/2506.10966/integrity","json":"/paper/2506.10966/citation-record.json","paper":"/paper/2506.10966"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:07.236363Z","title":"Pddl— the planning domain definition language","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.236363Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:cc261947653fdc6a0ff4eec59b20b749c814ca34fd980cd79564c14ab6bd7814","observation_id":"83198efd-4f67-47da-9516-c8cd967ef32f","resolution":{"observed_at":"2026-08-07T04:17:07.236363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.06757","last_updated":"2018-07-18T03:28:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-07-18T03:28:02Z","title":"On Evaluation of Embodied Navigation Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.06757","snapshot_observed_at":"2026-08-07T04:17:07.337820Z","title":"On evaluation of embodied navigation agents.arXiv preprint arXiv:1807.06757, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.337820Z"},"links":{"cited_paper":"/paper/1807.06757","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:94e8d3b2f40b6316b89aea97840e7f37fef27605f9a15b9ca289915813f9357c","observation_id":"a0c722ae-fbd4-4321-83f9-af4e88afa36f","resolution":{"observed_at":"2026-08-07T04:17:07.337820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:07.421431Z","title":"Claude ai, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.421431Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:9d276c39b07bdaf62bb4e4b0ea8878352b50783fa0de5308c080eba7abaab56d","observation_id":"887326da-1fab-4d7e-bf0c-6247328a7101","resolution":{"observed_at":"2026-08-07T04:17:07.421431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:07.496296Z","title":"Track2act: Predicting point tracks from internet videos enables diverse zero-shot robot manip- ulation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.496296Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a8dbdab54b63e94a4fa77c337c473c078c725fb6d01c3c29db597e2aa9a87a62","observation_id":"f9234ff2-7d04-4f81-ae9c-a0a4a6a8c999","resolution":{"observed_at":"2026-08-07T04:17:07.496296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-07T04:17:07.608183Z","title":"Rt-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.608183Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:ae87fb7bb2d43f00aa25adf9b7bbefc39b58f0aaae27cf2e3874ca0b396541c4","observation_id":"87440fc2-79de-4b75-8ff9-eefb01b605d9","resolution":{"observed_at":"2026-08-07T04:17:07.608183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T04:17:07.644953Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control.arXiv preprint arXiv:2307.15818, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.644953Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:0ed05fdf5fd19ba09707c0d1e20dc1e9f162e194f105a37ed4205144710c7fd6","observation_id":"50827982-8d42-48a5-875b-9169e3747c9b","resolution":{"observed_at":"2026-08-07T04:17:07.644953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:07.679138Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.679138Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a8b298e9a1ff8a3cda335bc94a430d9b42a0654582a3e86ae3c57aa777c3a421","observation_id":"e76fc7b9-b122-4a4d-9b03-377f18548c91","resolution":{"observed_at":"2026-08-07T04:17:07.679138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:07.742078Z","title":"Procthor: Large-scale embodied ai using procedural generation.Ad- vances in Neural Information Processing Systems, 35:5982– 5994, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.742078Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:0e3c1445aebc0bc15abd1f9241d0a29c25e1d8cc61a928215241d3a6e14a1374","observation_id":"7035777a-4503-4660-834c-6968da6f259f","resolution":{"observed_at":"2026-08-07T04:17:07.742078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:07.805487Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.805487Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:848e531062ec00b59ca4e4ba26ac10b2a3f4fbecb5293ae493280dcddec9a08f","observation_id":"7fd3207c-a4dc-482f-a723-eb3c84233b7b","resolution":{"observed_at":"2026-08-07T04:17:07.805487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13303","last_updated":"2024-08-13T17:20:34Z","snapshot_observed_at":"2026-08-05T04:52:42.687342Z","submitted_at":"2023-12-19T23:11:06Z","title":"RealGen: Retrieval Augmented Generation for Controllable Traffic Scenarios","version":2},"cited_work":{"arxiv_id":"2312.13303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.13303","snapshot_observed_at":"2026-08-07T04:17:14.073450Z","title":"RealGen: Retrieval Augmented Generation for Controllable Traffic Scenarios","venue":"cs.LG","work_id":"9cfbed93-cc0f-4ff8-ae70-10d515b5287d","year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.854351Z"},"links":{"cited_paper":"/paper/2312.13303","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a7b4e15f37fdc268b2594fe9a72957635460f589abd31cdd24f10433e1bf49dc","observation_id":"1cdb4ea3-49fc-4b21-9ac8-6d3c8f868483","resolution":{"observed_at":"2026-08-07T04:17:14.079113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:07.913806Z","title":"A survey on safety-critical driving scenario generation—a methodological perspective.IEEE Transactions on Intelligent Transportation Systems, 24(7): 6971–6988, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.913806Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:c73458ae32e3289424a78fd21e497b71f3c4d6478453159c9542662e8be89456","observation_id":"0be860bb-0e51-4034-ab53-f960892040f0","resolution":{"observed_at":"2026-08-07T04:17:07.913806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18915","last_updated":"2024-08-29T16:07:30Z","snapshot_observed_at":"2026-07-06T18:37:43.309281Z","submitted_at":"2024-06-27T06:12:01Z","title":"Manipulate-Anything: Automating Real-World Robots using Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18915","snapshot_observed_at":"2026-08-07T04:17:07.939920Z","title":"Manipulate- anything: Automating real-world robots using vision- language models.arXiv preprint arXiv:2406.18915, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.939920Z"},"links":{"cited_paper":"/paper/2406.18915","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:48e157ac45edf957a9723aba979ea25a6b511916bf470bcbe320ec800d7fa93b","observation_id":"cccfe068-1b98-40b2-8c65-3d6f8c0ad2a7","resolution":{"observed_at":"2026-08-07T04:17:07.939920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.04382","last_updated":"2024-05-02T16:17:25Z","snapshot_observed_at":"2026-08-03T02:34:23.883600Z","submitted_at":"2022-05-09T15:35:33Z","title":"FlowBot3D: Learning 3D Articulation Flow to Manipulate Articulated Objects","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.04382","snapshot_observed_at":"2026-08-07T04:17:07.993358Z","title":"Flowbot3d: Learning 3d articulation flow to manipulate articulated ob- jects.arXiv preprint arXiv:2205.04382, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:07.993358Z"},"links":{"cited_paper":"/paper/2205.04382","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:63f6f4bf30d3d139d19a999bc13affd5187a065b81a1ed7f3890b4c10ac31a90","observation_id":"24135056-5e69-46ee-88b9-2f6a495e8dba","resolution":{"observed_at":"2026-08-07T04:17:07.993358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.038497Z","title":"Anygrasp: Robust and efficient grasp perception in spa- tial and temporal domains.IEEE Transactions on Robotics,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.038497Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:e6f2cebcab01bc28620146a30b759a572533f4cb0880dc2d31e8b8c7ff3dbc3e","observation_id":"c2d2de9c-fe83-4da3-9b74-731913b6c216","resolution":{"observed_at":"2026-08-07T04:17:08.038497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.103878Z","title":"Active task randomization: Learning visuomotor skills for sequential manipulation by proposing feasible and novel tasks.CoRR, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.103878Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:02314205d6f46be3935fefd9df47cc1abe978fe2e97bf6bbd0b5b2ed20cf41d0","observation_id":"72e04039-40be-432b-a06c-a442fb39d959","resolution":{"observed_at":"2026-08-07T04:17:08.103878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.156813Z","title":"Helix: A vision-language-action model for gen- eralist humanoid control, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.156813Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:1d2a29ad5a866c10c2d9ee3352b7f4b51f446a2082707046e117f18d953fcc92","observation_id":"5488a891-ce19-4383-8ae0-5e7a7c15bb69","resolution":{"observed_at":"2026-08-07T04:17:08.156813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.211902Z","title":"Scenic: a language for scenario specification and scene generation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.211902Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:3b35edd038895d67d7f5efa270961da5e41f9aa2ca03842bfa8ea3045c2623e8","observation_id":"6e33a08d-0799-4257-a1ac-d61e4bb972c5","resolution":{"observed_at":"2026-08-07T04:17:08.211902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02117","last_updated":"2024-01-04T07:55:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T07:55:53Z","title":"Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02117","snapshot_observed_at":"2026-08-07T04:17:08.242838Z","title":"Mobile aloha: Learning bimanual mobile manipulation with low-cost whole-body teleoperation.arXiv preprint arXiv:2401.02117,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.242838Z"},"links":{"cited_paper":"/paper/2401.02117","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:07d8cb85158a67e19c48b7f410b9750091f754225451995362fe0959a77b101a","observation_id":"c932b5f8-00f3-4d24-bb46-3c2d358a1cca","resolution":{"observed_at":"2026-08-07T04:17:08.242838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01345","last_updated":"2025-03-01T22:11:10Z","snapshot_observed_at":"2026-08-07T10:35:18.002932Z","submitted_at":"2024-10-02T09:02:34Z","title":"Towards Generalizable Vision-Language Robotic Manipulation: A Benchmark and LLM-guided 3D Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01345","snapshot_observed_at":"2026-08-07T04:17:08.311238Z","title":"To- wards generalizable vision-language robotic manipulation: A benchmark and llm-guided 3d policy.arXiv preprint arXiv:2410.01345, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.311238Z"},"links":{"cited_paper":"/paper/2410.01345","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:0a95ce6da4de501b5cd41b78c240ff989731d17327ee0da7df9e254901f66fc9","observation_id":"5e501f3d-1b26-4343-a987-f881375e7591","resolution":{"observed_at":"2026-08-07T04:17:08.311238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.373688Z","title":"Skillmimicgen: Automated demonstration generation for efficient skill learning and deployment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.373688Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:62ca9c4dd74578bd005b9d8a31507a44526169ecf88a82878a47c6b942576a9c","observation_id":"96d067c9-e8c0-4273-b492-d399457ccf5c","resolution":{"observed_at":"2026-08-07T04:17:08.373688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.397256Z","title":"Gapartnet: Cross-category domain-generalizable object perception and manipulation via generalizable and actionable parts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.397256Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a7d16c3d646c21b2554a2048a364087348ff18843297b70b6aea1061046e11b4","observation_id":"ef1acecb-2ba5-4162-b6af-facb2e276ed8","resolution":{"observed_at":"2026-08-07T04:17:08.397256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.461345Z","title":"Arnold: A benchmark for language-grounded task learning with con- tinuous states in realistic 3d scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.461345Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:62be9ef35179906ea8ccb60dca9ca64f9d8d1692aeb66ac4a939c2abf62c6939","observation_id":"38d23a0c-2895-41d1-9af0-0b598be93c26","resolution":{"observed_at":"2026-08-07T04:17:08.461345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.529755Z","title":"Gemini api, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.529755Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a006d7e96fc7ccf746e4fe69b09f484574c92bd04bed40dae7f9424900fc2178","observation_id":"c2fb5500-db8b-4096-979a-2bc8559e0e04","resolution":{"observed_at":"2026-08-07T04:17:08.529755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08545","last_updated":"2024-06-12T18:00:01Z","snapshot_observed_at":"2026-07-06T18:29:53.755897Z","submitted_at":"2024-06-12T18:00:01Z","title":"RVT-2: Learning Precise Manipulation from Few Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08545","snapshot_observed_at":"2026-08-07T04:17:08.566688Z","title":"Rvt-2: Learning precise manipulation from few demonstrations.arXiv preprint arXiv:2406.08545, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.566688Z"},"links":{"cited_paper":"/paper/2406.08545","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:ff3458d69da64f2000c937659dee7af6a80ae326d4d7ab83c5a89c333debbbb8","observation_id":"d899cff8-9b08-4889-892e-3ab1332a6a6e","resolution":{"observed_at":"2026-08-07T04:17:08.566688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01977","last_updated":"2023-11-06T05:53:08Z","snapshot_observed_at":"2026-07-06T16:42:43.992849Z","submitted_at":"2023-11-03T15:31:51Z","title":"RT-Trajectory: Robotic Task Generalization via Hindsight Trajectory Sketches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01977","snapshot_observed_at":"2026-08-07T04:17:08.602998Z","title":"Rt-trajectory: Robotic task generalization via hindsight trajectory sketches","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.602998Z"},"links":{"cited_paper":"/paper/2311.01977","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:56ec225486b91b49f9cdd7b57d85e6876e3aed6154e0b5a1a05387f017f6174d","observation_id":"734333b9-a33e-44a7-9c24-c695df072297","resolution":{"observed_at":"2026-08-07T04:17:08.602998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.674560Z","title":"Maniskill2: A unified benchmark for generalizable manipulation skills","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.674560Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:36b2b6fe916a20f168f6ee6d583974475cff3929aff0990948c68386399d00b0","observation_id":"e84efe59-9cf7-4bca-a54e-9f4be7b19cd9","resolution":{"observed_at":"2026-08-07T04:17:08.674560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:08.717158Z","title":"MPlib: a Lightweight Motion Planning Library,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.717158Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:3df12a07f2408f92fc00d073ce02d8b9ac527192f71eff1dbedb0a68dab450c4","observation_id":"4e52279b-7af8-4914-ba1e-681bb1ec0f3b","resolution":{"observed_at":"2026-08-07T04:17:08.717158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12821","last_updated":"2023-05-22T08:29:00Z","snapshot_observed_at":"2026-08-01T20:31:21.496677Z","submitted_at":"2023-05-22T08:29:00Z","title":"FurnitureBench: Reproducible Real-World Benchmark for Long-Horizon Complex Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12821","snapshot_observed_at":"2026-08-07T04:17:08.780101Z","title":"Furniturebench: Reproducible real-world benchmark for long-horizon complex manipulation.arXiv preprint arXiv:2305.12821, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.780101Z"},"links":{"cited_paper":"/paper/2305.12821","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:8eb9b1978c91b1da961c53334f0069fb4c0537070ca31a852b5eb0623209990b","observation_id":"af9d2852-59a8-442a-92d6-75e858a5a0f6","resolution":{"observed_at":"2026-08-07T04:17:08.780101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17842","last_updated":"2023-12-24T03:48:40Z","snapshot_observed_at":"2026-08-07T02:37:30.672574Z","submitted_at":"2023-11-29T17:46:25Z","title":"Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17842","snapshot_observed_at":"2026-08-07T04:17:08.821795Z","title":"Look before you leap: Unveiling the power of gpt- 4v in robotic vision-language planning.arXiv preprint arXiv:2311.17842, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.821795Z"},"links":{"cited_paper":"/paper/2311.17842","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:362da234c2203ca389a8b777312ac645d0acdea72df6ead1326e482a0dfd5ac4","observation_id":"ade70b3d-d5c4-4b51-8e03-abe6fbd8aba5","resolution":{"observed_at":"2026-08-07T04:17:08.821795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08248","last_updated":"2024-03-13T05:03:58Z","snapshot_observed_at":"2026-08-02T02:09:06.312626Z","submitted_at":"2024-03-13T05:03:58Z","title":"CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08248","snapshot_observed_at":"2026-08-07T04:17:08.863737Z","title":"Copa: General robotic manipulation through spatial constraints of parts with foundation models.arXiv preprint arXiv:2403.08248, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.863737Z"},"links":{"cited_paper":"/paper/2403.08248","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:67f485ec9dff5d5e09ef320bb31525ac0c9720755201afca7435a0b80113a55e","observation_id":"cac4aca0-2baf-4a07-9777-3321c6d5d14d","resolution":{"observed_at":"2026-08-07T04:17:08.863737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12871","last_updated":"2024-05-09T17:35:44Z","snapshot_observed_at":"2026-08-05T10:01:43.401012Z","submitted_at":"2023-11-18T01:21:38Z","title":"An Embodied Generalist Agent in 3D World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12871","snapshot_observed_at":"2026-08-07T04:17:08.926212Z","title":"An embodied generalist agent in 3d world.arXiv preprint arXiv:2311.12871, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:08.926212Z"},"links":{"cited_paper":"/paper/2311.12871","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:aa5a1e18a0c9f4442d92aadf6ba9c7aa6d189c6091eb14b0f5fe9456cb2ad4f6","observation_id":"cf67ed40-80c8-41f3-b643-74c72305a002","resolution":{"observed_at":"2026-08-07T04:17:08.926212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-07T04:17:09.009338Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models.arXiv preprint arXiv:2307.05973, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.009338Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:7a2105acc2baaf7999042a815edfc33fbfb81a72b32e731619e0e0b3fafdf0aa","observation_id":"6dcb539d-fc74-4e67-acff-821cdd2c4b5d","resolution":{"observed_at":"2026-08-07T04:17:09.009338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.054421Z","title":"Rlbench: The robot learning benchmark & learning environment.IEEE Robotics and Automation Let- ters, 5(2):3019–3026, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.054421Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:9f4cc737c85af28f18094d6d221d71f8b9512c49acc4dc1d9794ad4c491293c1","observation_id":"838f89b8-a091-4fcb-826c-c708c0522ddf","resolution":{"observed_at":"2026-08-07T04:17:09.054421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.108993Z","title":"Sceneverse: Scaling 3d vision-language learning for grounded scene understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.108993Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:398226124c55f1bd686f904523f3bc35c61962f153cb1afd8e7b86ea168e92c5","observation_id":"e90258c3-f4c1-47b7-b191-9def291c62e1","resolution":{"observed_at":"2026-08-07T04:17:09.108993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03094","last_updated":"2023-05-28T07:32:38Z","snapshot_observed_at":"2026-08-07T13:44:24.778030Z","submitted_at":"2022-10-06T17:50:11Z","title":"VIMA: General Robot Manipulation with Multimodal Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03094","snapshot_observed_at":"2026-08-07T04:17:09.193134Z","title":"Vima: General robot manipulation with multimodal prompts.arXiv preprint arXiv:2210.03094, 2(3):6, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.193134Z"},"links":{"cited_paper":"/paper/2210.03094","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:499b3bbee6678212e0e5fb943e90108e50cedb891323be7371ce119c6c84708e","observation_id":"dac035ed-a010-45a7-99d1-4c5ce2b25572","resolution":{"observed_at":"2026-08-07T04:17:09.193134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-07-06T15:12:37.953383Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-07T04:17:09.261005Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.261005Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:ace6912d89404ee9ff66e3d003388e486fa49c81867f00bb28b9535065ce701d","observation_id":"9177a481-ea0a-47c4-bb3c-b158a60b56fe","resolution":{"observed_at":"2026-08-07T04:17:09.261005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-07-06T06:14:28.435222Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T04:17:09.324886Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.324886Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:7e5753e20f2c8f24d3488897e033a1255ff593038818be04b3bea3f0e7e26d65","observation_id":"65cf1253-22de-4e62-8a98-264988fc72db","resolution":{"observed_at":"2026-08-07T04:17:09.324886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.394021Z","title":"Visual genome: Connecting language and vision using crowdsourced dense image annotations.International journal of computer vision, 123:32–73, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.394021Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:ba0996896ad81d0bbea0114c3015bfa9109c14042d334bfef4f39cc3100f2b59","observation_id":"68837f12-c908-495f-b6bb-d9170cb052a1","resolution":{"observed_at":"2026-08-07T04:17:09.394021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.468992Z","title":"Behavior-1k: A benchmark for embodied ai with 1,000 ev- eryday activities and realistic simulation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.468992Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:6975bfea828bf9caf3f21306edcd60d6f10d5bdc21745f1b0954f3a09dabfe94","observation_id":"b3d3f192-855f-4476-9e03-eedaec392207","resolution":{"observed_at":"2026-08-07T04:17:09.468992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01378","last_updated":"2024-02-05T03:46:00Z","snapshot_observed_at":"2026-07-31T21:45:51.138808Z","submitted_at":"2023-11-02T16:34:33Z","title":"Vision-Language Foundation Models as Effective Robot Imitators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01378","snapshot_observed_at":"2026-08-07T04:17:09.575868Z","title":"Vision-language foun- dation models as effective robot imitators.arXiv preprint arXiv:2311.01378, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.575868Z"},"links":{"cited_paper":"/paper/2311.01378","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:7d7b1186d6dfc164fcd518e18e2eb3d292d4bc5e962f7be72d904e1638ee055b","observation_id":"ebc8f8a7-6d31-4b44-b8b3-bbad4f0e1b1b","resolution":{"observed_at":"2026-08-07T04:17:09.575868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05941","snapshot_observed_at":"2026-08-07T04:17:09.609772Z","title":"Evaluating real-world robot manipulation policies in simulation.arXiv preprint arXiv:2405.05941, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.609772Z"},"links":{"cited_paper":"/paper/2405.05941","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:edcbac3c9565a1f14abb3f38b4bb93b3f0dcff9b1e87de175f6d2a756b5e2746","observation_id":"fc24be92-cc92-4975-9336-e082e702db44","resolution":{"observed_at":"2026-08-07T04:17:09.609772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.701613Z","title":"Code as policies: Language model programs for embodied control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.701613Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:72c3690b053e889a45d24e8e3e6867a90bf817f68fd537fb3bbbf278de9b150e","observation_id":"834884a6-b7da-4954-9010-1755546380ad","resolution":{"observed_at":"2026-08-07T04:17:09.701613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.706774Z","title":"Libero: Benchmarking knowl- edge transfer for lifelong robot learning.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.706774Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:94b9215379b598f3dec97ad0fa2061f6ba0a5498c0198cf907110c2a32e16f91","observation_id":"c1d7077c-9c6b-488a-9acf-cd448285f4bf","resolution":{"observed_at":"2026-08-07T04:17:09.706774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.751966Z","title":"Moka: Open-vocabulary robotic manipulation through mark-based visual prompting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.751966Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:4fac266079eefa5a6f3d5618f52f4ed788ee2d8cf6a44c20144d608976ba6fa7","observation_id":"82bfbe20-4ea6-421d-a789-a32169ce83ad","resolution":{"observed_at":"2026-08-07T04:17:09.751966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:09.840480Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.840480Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:16b6047460261a726b8329459bb5425007885e47ccd3a00d32db5de693f55689","observation_id":"4d3c53d7-f540-4419-a0fc-bfd8ece47cee","resolution":{"observed_at":"2026-08-07T04:17:09.840480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10470","last_updated":"2021-08-25T23:42:59Z","snapshot_observed_at":"2026-07-06T11:40:56.544714Z","submitted_at":"2021-08-24T01:38:11Z","title":"Isaac Gym: High Performance GPU-Based Physics Simulation For Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10470","snapshot_observed_at":"2026-08-07T04:17:09.941516Z","title":"Isaac gym: High performance gpu-based physics simulation for robot learning.arXiv preprint arXiv:2108.10470, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.941516Z"},"links":{"cited_paper":"/paper/2108.10470","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:0ebdcad87bfd1f0b0fba61d5fa27c07c72a99e6cd4a7826cd59d16f4b64fe262","observation_id":"fa66c84f-c25a-41e7-928b-9a61afb10d11","resolution":{"observed_at":"2026-08-07T04:17:09.941516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17596","last_updated":"2023-10-26T17:17:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-26T17:17:31Z","title":"MimicGen: A Data Generation System for Scalable Robot Learning using Human Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17596","snapshot_observed_at":"2026-08-07T04:17:10.018884Z","title":"Mimicgen: A data generation system for scalable robot learning using human demonstrations.arXiv preprint arXiv:2310.17596, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.018884Z"},"links":{"cited_paper":"/paper/2310.17596","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:3782ee7b61d53204fb4fc7124bb1fd6004eb4eaa7f0467bb796dd0396f2b42a2","observation_id":"2cf78bc7-600e-4133-9597-eac5e271e9f9","resolution":{"observed_at":"2026-08-07T04:17:10.018884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:10.061068Z","title":"Calvin: A benchmark for language- conditioned policy learning for long-horizon robot manip- ulation tasks.IEEE Robotics and Automation Letters, 7(3): 7327–7334, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.061068Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:985264b54b7f5cec0f34c9b179f9e7a70ccddf5fbdc8042aede17cc4a11782f2","observation_id":"0256e076-13c5-4901-9752-4f713e0d10eb","resolution":{"observed_at":"2026-08-07T04:17:10.061068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:10.174111Z","title":"Simple open-vocabulary object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.174111Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:8e2c2eded036c05371be7e0662aad558266badf061d710cab44ac94b2333471f","observation_id":"d94732b8-e63a-4438-ae42-2ddfe86d2beb","resolution":{"observed_at":"2026-08-07T04:17:10.174111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02523","last_updated":"2024-06-04T17:41:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T17:41:31Z","title":"RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02523","snapshot_observed_at":"2026-08-07T04:17:10.262973Z","title":"Robocasa: Large-scale simula- tion of everyday tasks for generalist robots.arXiv preprint arXiv:2406.02523, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.262973Z"},"links":{"cited_paper":"/paper/2406.02523","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:608e307e74fda5aa69567dad119abc856f838cf06ce3387001c985a5fa4a724f","observation_id":"9b580a6b-f0ac-402d-bd69-cefbf422110f","resolution":{"observed_at":"2026-08-07T04:17:10.262973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.590871Z","title":"Pivot: Itera- tive visual prompting elicits actionable knowledge for vlms","venue":null,"work_id":"e755c256-1621-4c71-97f1-b5f9b43daf58","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.319888Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:0285cae8df212dd535fbc28ab5fe654db0ce2c3c9e08b34786ced9de1ff3ac37","observation_id":"e4e0a8ee-085b-42ef-b593-aaae1ee2491b","resolution":{"observed_at":"2026-08-07T04:17:14.594825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.578192Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":"d638b83e-3027-446e-8970-87113f82a5bc","year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.368028Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:2406735f664f8b4352ce14a4f6a2e7101f22c1968a6899bdc0fb9a54e30bad39","observation_id":"90e515f7-4f09-47dd-9167-52d35cdc4f75","resolution":{"observed_at":"2026-08-07T04:17:14.582211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-08-07T04:17:10.464849Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models.arXiv preprint arXiv:2310.08864, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.464849Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:e1ecc4c601744dbb4ec8ce2d4c0986c38c92158e080c36dbdd4c037e5486b0c1","observation_id":"d93f4eac-d7d6-4204-a349-be0be4e47ce6","resolution":{"observed_at":"2026-08-07T04:17:10.464849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:17:10.558832Z","title":"Gpt-4 technical report.arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.558832Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:b1f32f69ee28330335b82aabd3b96ccebe31d4dcb7bb69e2ba8ca11406ce40ca","observation_id":"79d99234-ec30-4418-99e3-e04299e1265b","resolution":{"observed_at":"2026-08-07T04:17:10.558832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08191","last_updated":"2024-05-28T00:37:02Z","snapshot_observed_at":"2026-08-05T06:18:26.955637Z","submitted_at":"2024-02-13T03:25:33Z","title":"THE COLOSSEUM: A Benchmark for Evaluating Generalization for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08191","snapshot_observed_at":"2026-08-07T04:17:10.598519Z","title":"The colosseum: A bench- mark for evaluating generalization for robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.598519Z"},"links":{"cited_paper":"/paper/2402.08191","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:771175206975dec23a221e2f93942d4b524758eb60e31db6ca2784be9e355d45","observation_id":"bc7e8207-af92-43ce-8de4-2b23cecd6dae","resolution":{"observed_at":"2026-08-07T04:17:10.598519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:10.645112Z","title":"Keto: Learning keypoint representations for tool manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.645112Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:9812b5b490efb0d727558a41d1d09e98247cef447e6d9e23a1cde2a37161b1a9","observation_id":"01338251-9136-4df7-923e-42728e40935c","resolution":{"observed_at":"2026-08-07T04:17:10.645112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:10.738596Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.738596Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:9177004cfa14a548d0bb206b6a7b9ad22994f05b115dcf616cce4c9226244760","observation_id":"a57a6c25-9b2d-4f17-a29b-d06dd4eabe8c","resolution":{"observed_at":"2026-08-07T04:17:10.738596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-07T04:17:10.858849Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.858849Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:bda9639d05e3269e9966292aa968a3246821467a7cacb137d8572bd4973b6aea","observation_id":"b14d933d-5d0f-4122-b732-cfbfb87e1e5f","resolution":{"observed_at":"2026-08-07T04:17:10.858849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-07T04:17:10.921465Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks.arXiv preprint arXiv:2401.14159,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.921465Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:69a19d23af91216584fa2e958a65f5b0f7bf353a8c01c76801ff84e33acbb744","observation_id":"50c1ff37-12cc-4f3d-be7d-0f4630a9e4b8","resolution":{"observed_at":"2026-08-07T04:17:10.921465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.548630Z","title":"Toolflownet: Robotic manipulation with tools via predicting tool flow from point clouds","venue":null,"work_id":"c0b88745-8981-4089-8a55-ff38a9e5ff0e","year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:10.972716Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:7ee81f3aff7825052beedfb4dbc43c9b38489d93258b75d63a763a8b9706d89a","observation_id":"e40665f0-ad48-41d7-bcd5-c28293869d31","resolution":{"observed_at":"2026-08-07T04:17:14.552482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.535706Z","title":"Alfred: A benchmark for interpreting grounded instructions for everyday tasks","venue":null,"work_id":"470a8d06-c705-48c9-954b-9b1e848593f5","year":2020},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.079153Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:1e59deb183ce38f71278d229495943eedbc95c9407578185ac987fa22386d650","observation_id":"c2e88cba-2c0d-4f92-a699-31dea03dde23","resolution":{"observed_at":"2026-08-07T04:17:14.540018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:11.170009Z","title":"Cliport: What and where pathways for robotic manipulation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.170009Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:f059e0ec7768953c82446e34d4efa9ed38bf39e61de13ecf7a2aeedf4f812447","observation_id":"628cd259-d6b2-4520-b18a-6d68abbdfba3","resolution":{"observed_at":"2026-08-07T04:17:11.170009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.515552Z","title":"Perceiver- actor: A multi-task transformer for robotic manipulation","venue":null,"work_id":"efff0a34-ff0e-441d-a849-b7c2276bf105","year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.302795Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:74a5d89604db95f471ee8bb067c6d25b43733ad0bfcbddbb51ebcc3918d923df","observation_id":"5277652e-5a0f-4ce4-925c-ac462aca1a86","resolution":{"observed_at":"2026-08-07T04:17:14.519405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00905","last_updated":"2023-10-25T21:45:24Z","snapshot_observed_at":"2026-07-06T14:57:35.878347Z","submitted_at":"2023-03-02T01:55:10Z","title":"Open-World Object Manipulation using Pre-trained Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00905","snapshot_observed_at":"2026-08-07T04:17:11.391124Z","title":"Open-world ob- ject manipulation using pre-trained vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.391124Z"},"links":{"cited_paper":"/paper/2303.00905","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:c1c9f035d0837bcca678fb5114ea43cc4a89fff839231694cacd0f6eee2cc0c7","observation_id":"d66f160d-33b8-4cbe-ac89-b41817523580","resolution":{"observed_at":"2026-08-07T04:17:11.391124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15109","last_updated":"2024-12-19T17:52:50Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:52:50Z","title":"Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15109","snapshot_observed_at":"2026-08-07T04:17:11.569241Z","title":"Predictive inverse dynamics models are scalable learners for robotic manipulation.arXiv preprint arXiv:2412.15109, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.569241Z"},"links":{"cited_paper":"/paper/2412.15109","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a0edc887040c69c92e4638da463e15b4518caa77dc2142c5f330530a6c309ee2","observation_id":"0bbbaf3a-e6b7-4e39-b31a-4fc0515692b6","resolution":{"observed_at":"2026-08-07T04:17:11.569241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.503398Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":"80744a52-5935-4075-9852-4944361117fb","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.655044Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:c368016abff382b052dc2e12c9c9d1f681d82a63402fdd6047705734169a1bb1","observation_id":"a5041262-c20d-441a-aae7-4f8043630952","resolution":{"observed_at":"2026-08-07T04:17:14.507051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:11.729633Z","title":"Robotap: Tracking arbitrary points for few-shot visual imitation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.729633Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:af5f168696b055f7e03b871149527865c729ed1cf74695245a4ceb78883ac4cf","observation_id":"be65a9d9-51ed-40fd-b761-28e5e6b9c1d9","resolution":{"observed_at":"2026-08-07T04:17:11.729633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10943","last_updated":"2024-07-15T17:40:46Z","snapshot_observed_at":"2026-07-06T18:46:39.497352Z","submitted_at":"2024-07-15T17:40:46Z","title":"GRUtopia: Dream General Robots in a City at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10943","snapshot_observed_at":"2026-08-07T04:17:11.814197Z","title":"Grutopia: Dream general robots in a city at scale.arXiv preprint arXiv:2407.10943, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.814197Z"},"links":{"cited_paper":"/paper/2407.10943","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:9a8b19d32bd4cbbcd22a9d4e81cb49513dd65dc8dcde2dfdfc52e03463ccdea2","observation_id":"7b2fccbe-2af8-4d9e-98d3-14afc41b1582","resolution":{"observed_at":"2026-08-07T04:17:11.814197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.481716Z","title":"Goal-auxiliary actor-critic for 6d robotic grasp- ing with point clouds","venue":null,"work_id":"2998e922-112f-4c20-8e62-6af9b58c48aa","year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:11.935509Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:e30b80709ae496390eb833a4da0b4532a6da07859831ecb2a00e4875b4f24113","observation_id":"0a873c8a-9e78-494d-80e5-0b144011948d","resolution":{"observed_at":"2026-08-07T04:17:14.486221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01361","last_updated":"2024-01-21T21:01:12Z","snapshot_observed_at":"2026-08-01T18:55:40.312376Z","submitted_at":"2023-10-02T17:23:48Z","title":"GenSim: Generating Robotic Simulation Tasks via Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01361","snapshot_observed_at":"2026-08-07T04:17:12.054993Z","title":"Gensim: Generating robotic simulation tasks via large language models.arXiv preprint arXiv:2310.01361,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.054993Z"},"links":{"cited_paper":"/paper/2310.01361","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:19b9344b5f30c1d00d07025b55a0526a27a362ff1263b5ef3bde523efc189702","observation_id":"97428efc-ef24-4e4d-bfcd-311c6dfe0685","resolution":{"observed_at":"2026-08-07T04:17:12.054993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-07T04:17:12.170933Z","title":"Any-point trajectory modeling for policy learning.arXiv preprint arXiv:2401.00025, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.170933Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a5d77b08d04cdbb77d770f22b60f72c005483649344dddb2311b858f6e14c465","observation_id":"3551655b-03cb-467c-8764-e2651764ea5b","resolution":{"observed_at":"2026-08-07T04:17:12.170933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13139","last_updated":"2023-12-21T05:34:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-20T16:00:43Z","title":"Unleashing Large-Scale Video Generative Pre-training for Visual Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13139","snapshot_observed_at":"2026-08-07T04:17:12.308337Z","title":"Unleashing large-scale video generative pre- training for visual robot manipulation.arXiv preprint arXiv:2312.13139, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.308337Z"},"links":{"cited_paper":"/paper/2312.13139","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:0703e1960295dbc2e9a0c8345287532527d1959d72a5f9303fcfaaacccd52f58","observation_id":"84556921-bde2-41ad-b260-c3a40eea619d","resolution":{"observed_at":"2026-08-07T04:17:12.308337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.469641Z","title":"Sapien: A simulated part-based interactive environment","venue":null,"work_id":"70e88a41-b1b2-4b53-9497-22995e1f0cdb","year":2020},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.404887Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:f0943bc90e0b003d7bb2ad72859d81daa0ebcf01931cce37292e935521571847","observation_id":"c3d7714c-a152-43a2-9e8d-d8d85e2efaf0","resolution":{"observed_at":"2026-08-07T04:17:14.473606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.457765Z","title":"Flow as the cross-domain manipulation interface","venue":null,"work_id":"07949adc-2add-40cf-85ec-5f9931bb6451","year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.466706Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:b58427eab77f2b730043a42cf210543739e589dd5cd1415903feeba1ce20f70b","observation_id":"b890839f-8646-4a0a-9d47-10a422ce9f53","resolution":{"observed_at":"2026-08-07T04:17:14.461621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T04:17:12.492921Z","title":"Set-of-mark prompting unleashes extraordinary visual grounding in gpt-4v.arXiv preprint arXiv:2310.11441, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.492921Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:57f1744fb91386733a0dc68c1cdcdfcf33aa2915b3b2fe39a6e0c64650ac5241","observation_id":"cb7bc328-be32-4553-8f89-6df636db2070","resolution":{"observed_at":"2026-08-07T04:17:12.492921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11439","last_updated":"2024-09-23T08:22:04Z","snapshot_observed_at":"2026-07-06T17:18:24.209069Z","submitted_at":"2024-01-21T09:39:11Z","title":"General Flow as Foundation Affordance for Scalable Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11439","snapshot_observed_at":"2026-08-07T04:17:12.613817Z","title":"General flow as foundation affordance for scalable robot learning.arXiv preprint arXiv:2401.11439, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.613817Z"},"links":{"cited_paper":"/paper/2401.11439","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:d4197093d3fea1fd3157ce245f1f7f226db50e02ed3d82e4fc3d47bb2987a74e","observation_id":"e025c7d8-1fd6-4386-bc00-70e040889545","resolution":{"observed_at":"2026-08-07T04:17:12.613817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10721","last_updated":"2024-06-15T19:22:51Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-15T19:22:51Z","title":"RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10721","snapshot_observed_at":"2026-08-07T04:17:12.693223Z","title":"Robopoint: A vision-language model for spatial affordance prediction for robotics.arXiv preprint arXiv:2406.10721, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.693223Z"},"links":{"cited_paper":"/paper/2406.10721","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:64bce86328684ddf73ba3e8122007a5949f222be118da118334805abc9540b4f","observation_id":"822ca968-e8f6-4d95-9ddf-8cea73989b70","resolution":{"observed_at":"2026-08-07T04:17:12.693223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03954","last_updated":"2024-09-27T02:43:48Z","snapshot_observed_at":"2026-08-01T16:34:39.855742Z","submitted_at":"2024-03-06T18:58:49Z","title":"3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03954","snapshot_observed_at":"2026-08-07T04:17:12.774293Z","title":"3d diffusion policy.arXiv preprint arXiv:2403.03954, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.774293Z"},"links":{"cited_paper":"/paper/2403.03954","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:ab17a93e1e6d90e8b6615def631355130e152e4e6c1085bb0fae404c76823f8e","observation_id":"6b826cab-c762-41ce-80bb-86efa507b5b3","resolution":{"observed_at":"2026-08-07T04:17:12.774293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.446274Z","title":"Transporter networks: Rearranging the visual world for robotic manipu- lation","venue":null,"work_id":"b86ff9fc-6191-4a4e-ba4f-43fe6a02f085","year":2021},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.891068Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:5f16b6f4354d5c38d8b3b7023b20a39fb70bfc65e8ce51d8bf783ebc495b674b","observation_id":"a62935ad-ef49-4001-bc89-d3c25fce063b","resolution":{"observed_at":"2026-08-07T04:17:14.449921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-07T04:17:12.984162Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware.arXiv preprint arXiv:2304.13705, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:12.984162Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a0e16f24ef6eefbbfd532640dca29db4f305b910578b3c25078f311cac4a977f","observation_id":"188daa05-9857-43f1-b471-62cdaa76dc88","resolution":{"observed_at":"2026-08-07T04:17:12.984162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.434239Z","title":"Vlmbench: A compositional benchmark for vision-and-language manipulation.Advances in Neural In- formation Processing Systems, 35:665–678, 2022","venue":null,"work_id":"27295b93-95a6-45ca-a706-67a1b8f40ff9","year":2022},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.038976Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:7e2b0ee4e5387035c2461832e239b58d2301b49f6344e7591eda19cefbd58083","observation_id":"5bd30194-1779-4faf-b82e-df15d29d93b5","resolution":{"observed_at":"2026-08-07T04:17:14.438263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.423096Z","title":null,"venue":null,"work_id":"beeeafe7-9f90-4a05-9ada-ec4f2f95f9ae","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.157043Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:c306b05fc55223db12eccb30580fb39682298d26f932f3a5d4e6c070c21fd636","observation_id":"de1915ac-7503-40cb-a939-a6a32bd93da4","resolution":{"observed_at":"2026-08-07T04:17:14.426619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.411423Z","title":"Camera setups for modular manipulation systems and learning-based methods in GENMANIP-BENCH","venue":null,"work_id":"43db9dca-d7d8-4ade-9770-c4cf6a9ed8c4","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.178845Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:eae224e95dc41846ee471352addcdb2e169f7948914d281d32e60d67b23b22aa","observation_id":"059f0616-3b25-4ea3-9ebf-c5fcc13e6605","resolution":{"observed_at":"2026-08-07T04:17:14.415390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.400471Z","title":"instruction","venue":null,"work_id":"85635753-416a-48ec-8bde-aeeb784ef09e","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.321276Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:fce22153179ca3a6d5ac87f0646cdb16eb56050c3245aaa527724b9ed0673412","observation_id":"df54b8f6-50a6-4e94-a9de-c4c17415ac86","resolution":{"observed_at":"2026-08-07T04:17:14.403890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.389085Z","title":"Algorithm 1 Layout construction pipeline","venue":null,"work_id":"f9b488ae-c3e8-46e1-992f-bf77f1c5b733","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.473649Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:3898d964d4ffda3efc387293975cfaba5ce724d2d6e41daa6e5238df43762b80","observation_id":"e44a56d3-4eb4-4dbb-a807-ffaadfb7df35","resolution":{"observed_at":"2026-08-07T04:17:14.392787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.377691Z","title":"Human annotators, with privileged access to the scene graph and USD files, use IsaacSim for detailed inspections","venue":null,"work_id":"add1bc01-bd35-4c7c-b68e-b32b39b2c9d5","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.482280Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:46500bc51a26eb305a91d7593e1f2c99b3ff1a6328a94663637c3eecb5c55f70","observation_id":"753f2459-402d-4519-8968-4025fe7713a0","resolution":{"observed_at":"2026-08-07T04:17:14.381342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.365913Z","title":null,"venue":null,"work_id":"77f652cc-a344-432f-a2b6-f5c9793d6e1c","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.486829Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:e9ec70f901a2e2e2e75f5133b6afeec9081103426a8d647731865e9471213a75","observation_id":"518e912b-4d2e-4c95-8360-92caf31d35c2","resolution":{"observed_at":"2026-08-07T04:17:14.369965Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.354047Z","title":"Figure 8.Human-in-the-Loop corrections of benchmark scenarios","venue":null,"work_id":"6c9a7184-2d92-4a6d-a7d1-29b9d8fae6f0","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.491179Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:7a6c02069a4064c99a00ce996707019ae36cdee4a93322eac1ba9999d70aaa82","observation_id":"b175ad91-e44c-4d42-bc36-6daa99598d3c","resolution":{"observed_at":"2026-08-07T04:17:14.357790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.342771Z","title":null,"venue":null,"work_id":"9e07deff-c22d-47d2-839e-4f031f2283b9","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.494972Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:e8bb13d21e9780e5d3c72b464761db4af60cfb81784d30741b50bdf6a5c8a6a2","observation_id":"4a98163c-f5ef-49da-8023-f3dd6f2013ab","resolution":{"observed_at":"2026-08-07T04:17:14.346468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.327588Z","title":"Following the approach of Mimicgen [47], we collect primitive skills from human teleoperation trajectories for these articulated objects, as illustrated in Figure A- 11","venue":null,"work_id":"8af4fb28-7418-4441-8f93-80b81dc1fa37","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.498701Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:50e83ba7fa72d16050fd543aa9a8d3da8e4d274b09d0f37101152ae4c80c331b","observation_id":"70cd6369-73ef-46cd-9784-2f50782f76fc","resolution":{"observed_at":"2026-08-07T04:17:14.331816Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.315651Z","title":"The BC data collection pipeline is shown in Figure A- 12","venue":null,"work_id":"a25a7241-04f5-44cb-881c-f29a2015c27a","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.502933Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:82a157403a47d049ccc6dadfb81f944aa64526187ea94205dd2c6785f546d155","observation_id":"058e3cdf-1893-4530-aab6-7694804084f0","resolution":{"observed_at":"2026-08-07T04:17:14.319510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.303798Z","title":"In this section, we detail the method for determining spatial relationships among these point clouds, encompassing horizontal, vertical, and multi-object interactions","venue":null,"work_id":"b3e30306-920c-4f26-866c-3eff54f11ef9","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.507515Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:1a733c5fb427ef60d706193011e406790057dca646326caefb1a3d14fcb4db90","observation_id":"11636d71-9baa-4526-a1e2-3070b3aa8a31","resolution":{"observed_at":"2026-08-07T04:17:14.307767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.291983Z","title":null,"venue":null,"work_id":"20a31421-bd07-4f56-b02d-e8543b3363bc","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.511340Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:ad8cf230f8a81b97b06ad3401deae9f88cd7657984a8b04a89598fcf1c02472e","observation_id":"5c6276f3-ad12-4eba-b53e-789c8bc5fa55","resolution":{"observed_at":"2026-08-07T04:17:14.295837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.280726Z","title":null,"venue":null,"work_id":"cc2a1354-ffed-4672-a28d-21a7efdd5665","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.514976Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:eaac860c15e2c6deb2b256875f29b88678dc51df34add2dba3ca5e347f9b5495","observation_id":"dd24eb1c-ff23-4de8-ba33-80fb8292ef0c","resolution":{"observed_at":"2026-08-07T04:17:14.284234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.269055Z","title":"The possible horizontal relationships are: •Left-Right: This relationship is determined when the point clouds overlap along the X-axis but not the Y-axis","venue":null,"work_id":"431afb94-cb1a-4eea-a61e-1df0b725dd41","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.518742Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:df550f739d9966bdd4312292ce9befe94e8f60e03fbe1d8bd4a239e36d54d85c","observation_id":"29212170-27de-4579-99c7-fde7ae56be8b","resolution":{"observed_at":"2026-08-07T04:17:14.272801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.257395Z","title":null,"venue":null,"work_id":"33f05a9a-ecc8-4e8f-aa17-7cd05498436d","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.522405Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:a2753dbd14e9d617d01eab9b6cc7ecbb904307b1b144d42d7d32cfe8cbc838bd","observation_id":"562a35ad-ee4d-4790-aab2-40c0b13acc1b","resolution":{"observed_at":"2026-08-07T04:17:14.260915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.245238Z","title":"•Supporting/Supported by: If the objects are in contact or near each other, the function checks if one object supports the other based on the overlap area ratio","venue":null,"work_id":"20760806-7ba4-40dd-a088-6ce2545422d3","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.526065Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:b7a47545460fe7ed348332c31c6a071cf56bfb148c7ccfc725313a6f861cb606","observation_id":"34994c6e-62ed-4d3d-a7ad-76b21cf3ebe4","resolution":{"observed_at":"2026-08-07T04:17:14.249156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.232886Z","title":null,"venue":null,"work_id":"3c97320c-efdc-47a5-b31d-4ef49f36cfa8","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.529521Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:b6ed406440971c714cb4bef62a2bb0a76246995d34725b7373085dd2a5004015","observation_id":"e13d5166-b9b1-4a6d-a037-55c715549818","resolution":{"observed_at":"2026-08-07T04:17:14.236863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.220568Z","title":null,"venue":null,"work_id":"70bfca8f-b2ff-4efc-9c66-566b6855b111","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.533084Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:81c19fb9ecbd68f69e3fc87ef15c11de5da3a430325d070c0c852f0aef39c581","observation_id":"84d0fa3b-461b-4866-b067-1b9e83c7d51f","resolution":{"observed_at":"2026-08-07T04:17:14.224157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:17:14.207623Z","title":null,"venue":null,"work_id":"c71e2ea8-7b67-49db-aede-4ebf61b15eaf","year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:13.536817Z"},"links":{"citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:909ff8fef30ae3bd56afdd7e020bfef5ba92b9138926475eec5c3c2a4758c1f2","observation_id":"2d861826-0561-404e-b7e2-1a06b13d3dbb","resolution":{"observed_at":"2026-08-07T04:17:14.211737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T13:44:57.666142Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":77,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":107},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 107 outbound references and 2 inbound Pith citation observations for arXiv:2506.10966."}