{"as_of":"2026-08-06T01:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb6684f342bde66c81c23c5a2b5ce28ab126c98e8c8b55ace1866e189e09f7cd","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T02:25:58.710432Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14341/citation-record","integrity":"/paper/2607.14341/integrity","json":"/paper/2607.14341/citation-record.json","paper":"/paper/2607.14341"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:52.960856Z","title":"Learning-based robotic grasping: A review,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:52.960856Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:9e8d02c3c64063df04c330a55bf4ef20f1ab57ba880f06b17ebea1c5414e8e77","observation_id":"b549457d-3c58-4fc8-9546-3eac49897f1d","resolution":{"observed_at":"2026-08-02T02:25:52.960856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:53.054686Z","title":"A review of robotic grasp detection technol- ogy,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:53.054686Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:83678f04fb1bee694d1a6cfa9c8e0e50c5b3563ec4592a1513cb06b75699dd95","observation_id":"f4c4f9c1-2546-485c-ba19-a8c8360c5c2a","resolution":{"observed_at":"2026-08-02T02:25:53.054686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:53.225767Z","title":"Vision-based robotic grasping from object localization, object pose estimation to grasp estimation for parallel grippers: a review,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:53.225767Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:0a61346a0f07027af549bb07a37ef651d12ff856133af6bd8f3df4efb4c8ca12","observation_id":"0a0d78a1-9818-4850-8831-a3d787a736fe","resolution":{"observed_at":"2026-08-02T02:25:53.225767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11793","last_updated":"2024-10-18T03:56:52Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:41:42Z","title":"FetchBench: A Simulation Benchmark for Robot Fetching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11793","snapshot_observed_at":"2026-08-02T02:25:53.359430Z","title":"Fetchbench: A simulation benchmark for robot fetching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:53.359430Z"},"links":{"cited_paper":"/paper/2406.11793","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:473884b6972485334792f013e4184eb5db8e61a280f3f2df37fef2fe945d4574","observation_id":"f0d2e3e3-25e0-4848-b938-936b5c6b8800","resolution":{"observed_at":"2026-08-02T02:25:53.359430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:53.456182Z","title":"Deep learning approaches to grasp synthesis: A review,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:53.456182Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:b1e38742819cf22708f85b1d4109d4fa2e04cfef8d037517888f60553814c32e","observation_id":"4c451e05-63a1-4e88-bd84-e59777814d59","resolution":{"observed_at":"2026-08-02T02:25:53.456182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:53.633348Z","title":"Technological development and optimization of pushing and grasping functions in robot arms: A review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:53.633348Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:ba2266a900be7a2e2acbefdf8a75056f76084b3b16db5ac088a193f05704fdc3","observation_id":"992f005b-cded-48e7-8284-df4c494c7fec","resolution":{"observed_at":"2026-08-02T02:25:53.633348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:53.803458Z","title":"Rlbench: The robot learning benchmark & learning environment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:53.803458Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:184402a40d2e01740584115724b8f58bb67851458e5e656953b96720882e97fd","observation_id":"7add2d23-0fb4-4121-b2f2-6ef98c5cdf7b","resolution":{"observed_at":"2026-08-02T02:25:53.803458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02523","last_updated":"2024-06-04T17:41:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T17:41:31Z","title":"RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02523","snapshot_observed_at":"2026-08-02T02:25:53.915422Z","title":"Robocasa: Large-scale simulation of everyday tasks for generalist robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:53.915422Z"},"links":{"cited_paper":"/paper/2406.02523","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:6f42d1165992c65930bde7118f1686bca8092fc6894c55393238ef71a9cf4edd","observation_id":"ee5b2145-f61a-49d0-8905-f4be36cc25c3","resolution":{"observed_at":"2026-08-02T02:25:53.915422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:54.101864Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learn- ing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.101864Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:31f434a8c515b7065964ea6eea4530d7f30f581bade8765c2f7ccc29b7b9cf68","observation_id":"db442526-d23b-4335-a32d-335e0a040c95","resolution":{"observed_at":"2026-08-02T02:25:54.101864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18194","last_updated":"2024-12-24T06:03:42Z","snapshot_observed_at":"2026-08-02T00:03:22.878669Z","submitted_at":"2024-12-24T06:03:42Z","title":"VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18194","snapshot_observed_at":"2026-08-02T02:25:54.279975Z","title":"Vlabench: A large-scale benchmark for language- conditioned robotics manipulation with long-horizon reasoning tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.279975Z"},"links":{"cited_paper":"/paper/2412.18194","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:5c5bdf3637e8fb6be67d2423932efd8589273dfb1005acb3eb914e6c9681a4f9","observation_id":"481223e8-41e8-4ee7-9ff0-c15a83959a0f","resolution":{"observed_at":"2026-08-02T02:25:54.279975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08191","last_updated":"2024-05-28T00:37:02Z","snapshot_observed_at":"2026-08-05T06:18:26.955637Z","submitted_at":"2024-02-13T03:25:33Z","title":"THE COLOSSEUM: A Benchmark for Evaluating Generalization for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08191","snapshot_observed_at":"2026-08-02T02:25:54.454462Z","title":"The colosseum: A benchmark for evaluating generalization for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.454462Z"},"links":{"cited_paper":"/paper/2402.08191","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:5c3ae7fe7b99bcdf1395b099b63bfa914749c1cb95e934f40ea0da8021cf75ed","observation_id":"115bbf6f-4d85-4686-afd1-4926df2be9b7","resolution":{"observed_at":"2026-08-02T02:25:54.454462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:54.554004Z","title":"Graspnet-1billion: A large- scale benchmark for general object grasping,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.554004Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:d7f02851005a438c223fab599ae834571a008e0414170e634643a24a06a197ac","observation_id":"eabe649b-aad4-4cec-bc08-c97bd1a218bd","resolution":{"observed_at":"2026-08-02T02:25:54.554004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:54.666784Z","title":"Grasp-anything: Large-scale grasp dataset from foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.666784Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:b09745c6c2ad17fd8819f9e60df8d823ec6669d2efadde7f69ed00d05406031b","observation_id":"17455cba-e96e-4249-9f85-477cf37e7a52","resolution":{"observed_at":"2026-08-02T02:25:54.666784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:54.783235Z","title":"Fmb: a functional manipulation benchmark for generalizable robotic learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.783235Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:34cab9e503827b09a66fcbbaef193f41b9273fdc9c06d3b0a8c07e51c3725cb0","observation_id":"84a04faa-888d-4ad7-8b3b-04e2b5394f0f","resolution":{"observed_at":"2026-08-02T02:25:54.783235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03233","last_updated":"2025-08-27T03:43:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-06T06:59:28Z","title":"GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03233","snapshot_observed_at":"2026-08-02T02:25:54.877415Z","title":"Graspvla: a grasping foundation model pre-trained on billion-scale synthetic action data,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:54.877415Z"},"links":{"cited_paper":"/paper/2505.03233","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:e0ac078e07eead4c86d4faae41ea5d8eccc8f38f4dc381c5e32b4fea233bc049","observation_id":"17094bd7-9c68-4521-82d7-398ffbc50068","resolution":{"observed_at":"2026-08-02T02:25:54.877415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:55.018525Z","title":"Suctionnet-1billion: A large- scale benchmark for suction grasping,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.018525Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:69f16625b30e53884994a68a15547d02822bbecd12c94ccb9d480874c59e3a2b","observation_id":"ee64c539-4453-480d-a6ce-5db3d70bc4f7","resolution":{"observed_at":"2026-08-02T02:25:55.018525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:55.207636Z","title":"Multi-fingan: Generative coarse-to- fine sampling of multi-finger grasps,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.207636Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:2cea7b891088c125055148dda6dc644605885d4f50b3810919a47445de7afa67","observation_id":"dfaf7457-1f99-44a1-bf1c-6522bf06a9e2","resolution":{"observed_at":"2026-08-02T02:25:55.207636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:55.337023Z","title":"Adagrasp: Learning an adaptive gripper-aware grasping policy,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.337023Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:11294efe31c419a02c30157f421df487beaa143ea4615318ccb464fcab08f2e5","observation_id":"23b68a2e-9a91-4aec-8ba2-1edca56d49b2","resolution":{"observed_at":"2026-08-02T02:25:55.337023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:55.406861Z","title":"Jacquard: A large scale dataset for robotic grasp detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.406861Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:489b3d230c2fb7d013e6d0b457379a2ae61d06bd1c6d6541243c07c99a91ae65","observation_id":"66bb28aa-5075-4b7e-8389-5db5c0ced4d7","resolution":{"observed_at":"2026-08-02T02:25:55.406861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:55.478646Z","title":"Language-driven grasp detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.478646Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:31e134696d226bc11012a35ddb1ef561ed6d613d73ad245cdd594f0e42726e20","observation_id":"08402123-5cd3-4148-b7e0-8d37d27fe950","resolution":{"observed_at":"2026-08-02T02:25:55.478646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:55.629751Z","title":"Open-vocabulary affordance detection in 3d point clouds,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.629751Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:66cb623f12fa21f1817891a2b8f283c6fc3325f3d94e7ece749fe1363e24d97b","observation_id":"dd494717-3d38-467a-872f-cf1da2d166a5","resolution":{"observed_at":"2026-08-02T02:25:55.629751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00905","last_updated":"2023-10-25T21:45:24Z","snapshot_observed_at":"2026-07-06T14:57:35.878347Z","submitted_at":"2023-03-02T01:55:10Z","title":"Open-World Object Manipulation using Pre-trained Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00905","snapshot_observed_at":"2026-08-02T02:25:55.766741Z","title":"Open- world object manipulation using pre-trained vision-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.766741Z"},"links":{"cited_paper":"/paper/2303.00905","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:b29f735ddd2eb9d94f330bac0448b3a1d4f506e0a551cdbb37c7e6aa5fb4a237","observation_id":"7382167f-f5a6-4da5-91ab-de49c429aa6d","resolution":{"observed_at":"2026-08-02T02:25:55.766741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:55.888982Z","title":"Review of deep reinforcement learning-based object grasping: Techniques, open challenges, and recommendations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:55.888982Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:fc538603e5f4bda7b83957024a03d86734679cee9c58a54e9595dfef420fa159","observation_id":"8521f752-da7a-4d51-a196-6981e710dc77","resolution":{"observed_at":"2026-08-02T02:25:55.888982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.021711Z","title":"Learning for a robot: Deep reinforcement learning, imitation learning, transfer learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.021711Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:dd42ccbbd115c9c89936dff71e2f47421ca7a572bf3a3170676dd3c1002918e4","observation_id":"6c841a70-0448-4154-8e68-5e869b13eff1","resolution":{"observed_at":"2026-08-02T02:25:56.021711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.073500Z","title":"Ocrtoc: A cloud-based competition and benchmark for robotic grasping and manipulation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.073500Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:dbc3b18d58350d282226725ba8005239af51dd28046c526c156f73c2e93a2963","observation_id":"72d9caa6-be34-4ed9-acd4-39ad99b01b33","resolution":{"observed_at":"2026-08-02T02:25:56.073500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.139910Z","title":"Lightweight language-driven grasp detection using con- ditional consistency model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.139910Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:a1bdcdda3f63170ba6b64c78db695aa52b7a0d4d87f558dcb95b7de902396ae8","observation_id":"0ee53e5c-a0c5-4a4b-a4bb-8aca19f469f6","resolution":{"observed_at":"2026-08-02T02:25:56.139910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-02T02:25:56.230460Z","title":"π 0: A vision-language- action flow model for general robot control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.230460Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:22380f3d0e0a117dc7c3a3707aac50181f35a007699f9de38fe0bccde65aba3b","observation_id":"5ad7442a-09d1-4fd7-897d-d02608eba20d","resolution":{"observed_at":"2026-08-02T02:25:56.230460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.293219Z","title":"Anygrasp: Robust and efficient grasp perception in spatial and temporal domains,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.293219Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:554c0b5bbd45803786b93d53963c1294e23f3bf157519eb7ae6a982bf93d7a5b","observation_id":"07291054-e128-4166-b41b-40e588a9b30c","resolution":{"observed_at":"2026-08-02T02:25:56.293219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.366198Z","title":"Language-driven 6-dof grasp detection using negative prompt guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.366198Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:ab5e3e573170f23d9c8a91f3cf929f48fc098cd4d894ed0adcf698af50b35810","observation_id":"92814a9c-4eb8-4a96-994d-cfac2e87b65a","resolution":{"observed_at":"2026-08-02T02:25:56.366198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.483140Z","title":"Curobo: Parallelized collision-free robot motion generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.483140Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:5702e17baf05426c7325b519f20bc3860e68d397aa412326be0a5926da7e128d","observation_id":"08c8d399-b897-42cd-bae0-ff2cc9cf77d3","resolution":{"observed_at":"2026-08-02T02:25:56.483140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01307","last_updated":"2024-03-30T10:46:34Z","snapshot_observed_at":"2026-07-06T16:56:09.624313Z","submitted_at":"2023-12-03T07:22:42Z","title":"SAGE: Bridging Semantic and Actionable Parts for GEneralizable Manipulation of Articulated Objects","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01307","snapshot_observed_at":"2026-08-02T02:25:56.650661Z","title":"Sage: Bridging semantic and actionable parts for generalizable manipulation of articulated objects,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.650661Z"},"links":{"cited_paper":"/paper/2312.01307","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:3f6f26917257da2af9f356f55a9ebb78f5efb654398566ab72408ca4a6f42c7c","observation_id":"39ac8dd9-3b8b-4ef8-9e45-108b0c9dd79e","resolution":{"observed_at":"2026-08-02T02:25:56.650661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.799052Z","title":"Efficient end-to-end detection of 6-dof grasps for robotic bin picking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.799052Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:bb93f09906f3c44237e00b0800ec423c5fe57ec790c0c2911fa006fa50bb0fdd","observation_id":"21d96003-ef7a-4933-bd53-13d43843051c","resolution":{"observed_at":"2026-08-02T02:25:56.799052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:56.968747Z","title":"Semgrasp: Semantic grasp generation via language aligned discretization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:56.968747Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:05fd3b70315be8fa0de591cc169eb92baf2e7dcc6309b51bdbced0fa61e0e1c6","observation_id":"6e5c0c20-dd4b-4e16-b1d7-8c44849f44fc","resolution":{"observed_at":"2026-08-02T02:25:56.968747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.086015Z","title":"An end-to-end multi- dimensional perception network architecture for robotic grasp detec- tion with target edge collision-aware strategy,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.086015Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:f1ddfe0985d677e496111e14cc4daf22ae5810f04b719a65a92d1e3e64b6146d","observation_id":"a7a3183a-4fed-45ab-b1ed-3200da210a8f","resolution":{"observed_at":"2026-08-02T02:25:57.086015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.136822Z","title":"Simulated and real robotic reach, grasp, and pick-and-place using combined reinforcement learning and traditional controls,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.136822Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:95143d7b4f135b1cb7a4167b1741e682be6b9ba0da8a0dd0748b233e93353360","observation_id":"ba9bf6fe-216c-4142-b435-79673bd832e2","resolution":{"observed_at":"2026-08-02T02:25:57.136822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.189162Z","title":"Review of reinforcement learning for robotic grasping: Analysis and recommendations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.189162Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:7a6f7053d3e1e1e6f798f11d41e286e1f7819f9895b9e77f4ccd7fbe67fdc8c4","observation_id":"8df53914-ea4e-4ce6-b2a7-5ce985b89351","resolution":{"observed_at":"2026-08-02T02:25:57.189162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.260164Z","title":"A novel robotic grasping method for moving objects based on multi- agent deep reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.260164Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:d14b9d30a69a80dcc9b9807640ba7beea530c23e63007d270ecaaa0b67fbccb5","observation_id":"e1fbaf1b-375e-43d1-ae1b-10bdde41a802","resolution":{"observed_at":"2026-08-02T02:25:57.260164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.374638Z","title":"Robot grasp planning: A learning from demonstration-based approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.374638Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:e1c484ed2e7b8a52ee051500530f4d470c93ea46dd3b0318250431b81426e95d","observation_id":"cd433dd2-a835-4812-96f3-0931d80432a9","resolution":{"observed_at":"2026-08-02T02:25:57.374638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.526366Z","title":"Grasping in the wild: Learning 6dof closed-loop grasping from low-cost demonstrations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.526366Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:21cd4ab8368b822895ab8836ec8fe65f3a0720775052000770c15e421a22c322","observation_id":"b870ca83-0576-4201-baf0-bb0ecbdea34f","resolution":{"observed_at":"2026-08-02T02:25:57.526366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.582545Z","title":"Dexgraspvla: A vision-language-action framework towards general dexterous grasping,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.582545Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:df4cc63a005b71bd5aa34383af63e14c5e7cdd7f89cbd349f05611e02d8f1fd6","observation_id":"46f2f12b-c2a5-4427-a962-efa9cfbc1943","resolution":{"observed_at":"2026-08-02T02:25:57.582545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13097","last_updated":"2025-07-17T13:09:28Z","snapshot_observed_at":"2026-07-06T21:58:42.883962Z","submitted_at":"2025-07-17T13:09:28Z","title":"GraspGen: A Diffusion-based Framework for 6-DOF Grasping with On-Generator Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13097","snapshot_observed_at":"2026-08-02T02:25:57.702817Z","title":"Graspgen: A diffusion-based framework for 6-dof grasping with on- generator training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.702817Z"},"links":{"cited_paper":"/paper/2507.13097","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:dffa97de32898c75d99673479aaf5cc3e73379a455ebeca76be619bde56facfd","observation_id":"bfbf8cea-36e7-4a4e-aa6c-c6ba8e311217","resolution":{"observed_at":"2026-08-02T02:25:57.702817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.775880Z","title":"Gaussiangrasper: 3d language gaussian splatting for open-vocabulary robotic grasping,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.775880Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:2739688842a518362b1fe56347994249301fdb36a23717a4056efd161a1d2de5","observation_id":"046a6f9f-a22f-4ed0-8cf8-e2e0e464e4b5","resolution":{"observed_at":"2026-08-02T02:25:57.775880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03143","last_updated":"2015-02-10T22:46:01Z","snapshot_observed_at":"2026-07-06T04:08:52.584957Z","submitted_at":"2015-02-10T22:46:01Z","title":"Benchmarking in Manipulation Research: The YCB Object and Model Set and Benchmarking Protocols","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03143","snapshot_observed_at":"2026-08-02T02:25:57.859083Z","title":"Benchmarking in manipulation research: The ycb object and model set and benchmarking protocols,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.859083Z"},"links":{"cited_paper":"/paper/1502.03143","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:7d92ad0f631de1cb9713d84eb28f60c564a32d6e6b9413fc3942e8d9c0a3e937","observation_id":"b99897ff-6166-4416-bb99-e7f225c78134","resolution":{"observed_at":"2026-08-02T02:25:57.859083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:57.939380Z","title":"Introducing ChatGPT,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:57.939380Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:27cc338d42a2b58fd1fb45d22e5c5317e269e7e8bb1c49f7cfab982323f97afe","observation_id":"dd0b77b2-9375-4ef5-928f-522868353bbc","resolution":{"observed_at":"2026-08-02T02:25:57.939380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:58.047682Z","title":"Orbit: A unified simulation framework for interactive robot learning environments,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:58.047682Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:05a9b64e17a067072910c540096387f110892c17f45188967b2b742610c41f47","observation_id":"91903da2-1a11-4638-9b0e-603099c8e1e1","resolution":{"observed_at":"2026-08-02T02:25:58.047682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:58.084115Z","title":"Multi- grippergrasp: A dataset for robotic grasping from parallel jaw grippers to dexterous hands,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:58.084115Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:ba80e3160cc3be32d43da77be992c37850d4a2dcb42182c9cfb654c9261ed489","observation_id":"78d020b8-4486-43ad-ab8a-de2fa2fcd8d3","resolution":{"observed_at":"2026-08-02T02:25:58.084115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-02T02:25:58.227477Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:58.227477Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:82d7971cc4ddafd324de05ced41b992aa97e3fc7c480509cf5d5ac2b44264085","observation_id":"b196a237-f469-4351-a092-f8cf1aca4399","resolution":{"observed_at":"2026-08-02T02:25:58.227477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:25:58.372158Z","title":"Graspmas: Zero-shot language-driven grasp detection with multi-agent system,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:58.372158Z"},"links":{"citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:d0e8f5a3edfbc67b5645463c0816cc4385a8e7afc8aa80d824da71d5b64683d7","observation_id":"ba982756-80f6-424e-abab-c2d8e1b3643f","resolution":{"observed_at":"2026-08-02T02:25:58.372158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-02T02:25:58.451187Z","title":"Openvla: An open- source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:58.451187Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:ad3e0c9e1c02e9c7d88115a2dbbb8856c34c256d70e4ec83149319e19d8fd267","observation_id":"823e4fe3-0807-488b-a04d-653da6e3bc41","resolution":{"observed_at":"2026-08-02T02:25:58.451187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-02T02:25:58.504157Z","title":"Fine-tuning vision-language- action models: Optimizing speed and success,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:58.504157Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:8d8abeca0649102edefba26d22505bccb821582b13bb712a758884dfff2a4b9d","observation_id":"bbd75eca-1d70-4cc8-9d60-d634b6726302","resolution":{"observed_at":"2026-08-02T02:25:58.504157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-02T02:25:58.710432Z","title":"π 0.5 : a vision-language-action model with open-world generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T02:25:58.710432Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.14341"},"observation_digest":"sha256:1b7e5fe8ded2299d418519f7a8d71981338013a4f18849e5528337bfb5409982","observation_id":"5e883cad-ea43-482d-8f5d-a4e380b1a7a8","resolution":{"observed_at":"2026-08-02T02:25:58.710432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14341","last_updated":"2026-07-15T20:10:09Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-02T02:25:52.126724Z","submitted_at":"2026-07-15T20:10:09Z","title":"Beyond Visual Grasping: Benchmarking Complex Grasping from Detection to Execution"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2607.14341."}