{"as_of":"2026-08-08T04:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ec4e7afc8d5deed89651cc4475b0aad25ab782b83fd8101f7c4b661016e3a7f","coverage":[{"denominator":135,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:58:54.442710Z","state":"measured"},{"denominator":106,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":106,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T23:55:43.237396Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:29:51.374178Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-08-04T23:55:43.237396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06233","last_updated":"2025-09-07T22:45:06Z","snapshot_observed_at":"2026-08-08T03:23:24.154301Z","submitted_at":"2025-09-07T22:45:06Z","title":"O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T23:55:43.237396Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2509.06233"},"observation_digest":"sha256:946dbd843b9000c1ca0913f87229e2ff03dcefafa8f70e1a36e7fc14ae65dce1","observation_id":"6cd554e9-e642-4c18-bc2d-36fcc1ccb097","resolution":{"observed_at":"2026-08-04T23:55:43.237396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2509.19102","last_updated":"2026-05-17T17:21:02Z","snapshot_observed_at":"2026-07-06T22:30:36.671861Z","submitted_at":"2025-09-23T14:49:05Z","title":"FUNCanon: Learning Pose-Aware Action Primitives via Functional Object Canonicalization for Generalizable Robotic Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T22:15:10.709760Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2509.19102"},"observation_digest":"sha256:32242d3ff869096bbcd1d7180d0faaaa56638cbf19a573a5d9bc032dee65f344","observation_id":"56a9b232-db5b-4a71-8a53-55d83c6a72d2","resolution":{"observed_at":"2026-05-21T22:15:41.936416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2510.01433","last_updated":"2026-04-15T19:41:35Z","snapshot_observed_at":"2026-07-29T19:10:23.857765Z","submitted_at":"2025-10-01T20:13:39Z","title":"AFFORD2ACT: Affordance-Guided Automatic Keypoint Selection for Generalizable and Lightweight Robotic Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T10:17:53.226866Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2510.01433"},"observation_digest":"sha256:f9c70ecda827a5b2ff32ba8a1ea31a1cf790130da51a55347fa074710a3d9882","observation_id":"4a9f8d5c-7ad7-447b-a482-656535a2962f","resolution":{"observed_at":"2026-05-18T10:21:15.252945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2606.08655","last_updated":"2026-06-07T14:50:44Z","snapshot_observed_at":"2026-08-02T12:44:43.645151Z","submitted_at":"2026-06-07T14:50:44Z","title":"PhysGraph: A Physics-aware 3D Scene Graph for Perception and Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T18:13:55.537524Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2606.08655"},"observation_digest":"sha256:e0348ad85dc57bf34cdf7953e7f8e119c3ff5640ed4c63b4ffe997fc59fbb101","observation_id":"4043f4c3-6df1-4da3-9d13-eb45b50bc92e","resolution":{"observed_at":"2026-07-02T23:27:27.449919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2606.27036","last_updated":"2026-06-25T13:42:26Z","snapshot_observed_at":"2026-07-07T00:01:20.448165Z","submitted_at":"2026-06-25T13:42:26Z","title":"RelAfford6D: Relational 6D Affordance Graphs for Constraint-Driven Robotic Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T05:12:52.994218Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2606.27036"},"observation_digest":"sha256:57b1e470a085ec8257475b19023bded7891b28d2e3c261a78e93381de9ca3d1e","observation_id":"21bbfbdb-2721-446c-b993-90b9053c1ea8","resolution":{"observed_at":"2026-07-04T13:29:51.375616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-12T11:41:59.158887Z","title":"https://arxiv.org/abs/2506.09284 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02549","last_updated":"2026-06-25T22:09:56Z","snapshot_observed_at":"2026-08-06T19:02:30.842823Z","submitted_at":"2026-06-25T22:09:56Z","title":"Learning 3D Affordances for Blade Insertion in Cluttered Stowing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T11:41:59.158887Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2607.02549"},"observation_digest":"sha256:4642e4e0483aad84823da9ec5b10ba7c35e9be3a609be32065c5f0a64f318ac3","observation_id":"a4bc107a-92b2-4b83-81c2-58893c2c8a04","resolution":{"observed_at":"2026-07-12T11:41:59.158887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09284/citation-record","integrity":"/paper/2506.09284/integrity","json":"/paper/2506.09284/citation-record.json","paper":"/paper/2506.09284"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:30.681659Z","title":"To afford or not to afford: A new formalization of affordances toward affordance-based robot control,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:30.681659Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:39134addb17ce2bf81510a9ed1f022e71c0b3848d292031f846bd56af134a0d7","observation_id":"19e8b9a2-f1fa-4670-a93f-2dea150ae7ab","resolution":{"observed_at":"2026-08-07T04:58:30.681659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:31.351855Z","title":"Affordances from human videos as a versatile representation for robotics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:31.351855Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f717307ed3df85d98f5b8b420be40f4633e4202e8dc7132d3ca6d7b102426878","observation_id":"bb9ee850-dc16-4e3c-9c0a-708d2647d80f","resolution":{"observed_at":"2026-08-07T04:58:31.351855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:33.794425Z","title":"Ditto in the house: Building articulation models of indoor scenes through interactive perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:33.794425Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:e422622e089952df778c2a4e3401759bb3213903b65c9479aefa88aacb978d19","observation_id":"b39fab20-d013-4a93-a4dc-970afa3c8729","resolution":{"observed_at":"2026-08-07T04:58:33.794425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:35.359203Z","title":"Affordances in psychology, neuroscience, and robotics: A survey,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:35.359203Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:4dbca2841f5461cc729244e55d35cd675489d71431ceb068b64dbf82260c98c7","observation_id":"e3943fe9-5529-48eb-afe4-0d0002898911","resolution":{"observed_at":"2026-08-07T04:58:35.359203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:36.382491Z","title":"A brief review of affordance in robotic manipulation research,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:36.382491Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:4a3721cefbce61cf5508180a53e215a5f0de8762704907edd8afc38ba106f571","observation_id":"be99691a-7fa5-476f-87d5-1a06caf53f45","resolution":{"observed_at":"2026-08-07T04:58:36.382491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:39.806659Z","title":"Visual affordance and function understanding: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:39.806659Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:ffd79e1888f4d9603cb479dfe8d13e384ff36ca9a56829b33d883f9e9363a940","observation_id":"e2fe8bfa-5788-4923-b167-3981c973a895","resolution":{"observed_at":"2026-08-07T04:58:39.806659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:40.076269Z","title":"A survey of visual affordance recognition based on deep learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:40.076269Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1679193fad0e9b85d060c78c1165d82f324aa5eaea0bace27275f2301c7fbbaf","observation_id":"d3deb891-c68f-4445-9f43-d683ce299352","resolution":{"observed_at":"2026-08-07T04:58:40.076269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:41.466880Z","title":"A survey of semantic reasoning frameworks for robotic systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:41.466880Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d36218aa5c3e798252199b90737030eb9f0268d57fe30fe85b5d3442f59fcc88","observation_id":"c065643b-b675-44f5-b9dc-3e942032f51f","resolution":{"observed_at":"2026-08-07T04:58:41.466880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:43.490512Z","title":"Recent advances of deep robotic affordance learning: a reinforcement learning perspective,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:43.490512Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:958e093f1bcf6c478092df47f572b465a9db5e2980febc2e3468a92c6f7b3af9","observation_id":"61f90d88-5b70-4eb9-b8fe-f39e30a8cd32","resolution":{"observed_at":"2026-08-07T04:58:43.490512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:43.674169Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:43.674169Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:8f44497c948efcd2d13801ffa9ad896df5296eb2585386a8ede53af529634839","observation_id":"af0d3b4f-4186-444f-85bb-fe16864ce4a7","resolution":{"observed_at":"2026-08-07T04:58:43.674169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T04:58:43.839685Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:43.839685Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:7ea67648f939bdfcbcd5d3ecaa1e1fb68f99c17a6b608f4e6335b94ee2c34bb3","observation_id":"d666e44e-417f-4b3e-a866-387c9faf4d04","resolution":{"observed_at":"2026-08-07T04:58:43.839685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:58:44.003575Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.003575Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:bd1e7822d7103eb2f83ada2d3ccf0fc7321bc794d7d37e2040b548557d4095d4","observation_id":"f0a8176c-0b00-48b6-be42-b3cd498f04d8","resolution":{"observed_at":"2026-08-07T04:58:44.003575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.137035Z","title":"Emerging properties in self-supervised vision trans- formers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.137035Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:759baa5c2d663608234ee29ea1cd90e86d6b8f8f84ddf0619c79d983b9ff869e","observation_id":"7790e4cf-6e35-4d27-87d0-6dc71eedc310","resolution":{"observed_at":"2026-08-07T04:58:44.137035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T04:58:44.266795Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.266795Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9c7fba8669663c9f20d47cbc6510ee4de5ed01b80928d43d2369e623f4c9e496","observation_id":"5ff11940-2363-4524-909a-d9bf2fb1d55e","resolution":{"observed_at":"2026-08-07T04:58:44.266795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.13196","last_updated":"2023-05-25T05:47:29Z","snapshot_observed_at":"2026-07-06T13:46:11.811720Z","submitted_at":"2022-08-28T10:32:47Z","title":"Grounded Affordance from Exocentric View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.13196","snapshot_observed_at":"2026-08-07T04:58:44.421123Z","title":"Grounded affordance from exocentric view,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.421123Z"},"links":{"cited_paper":"/paper/2208.13196","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d0c33a089327f2051f9f387da03d4b373824089b923c7b13a7766dc61d0bbef1","observation_id":"e3f79409-8a4b-4cfd-99ca-dd4a6fd9b044","resolution":{"observed_at":"2026-08-07T04:58:44.421123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.571024Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.571024Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1024321b6f5478f5ab9e34314aa5bcc208e84159e7cd4501256f0e4ebcb81d02","observation_id":"619e33a8-d6fb-4bdb-89b3-b14a80874923","resolution":{"observed_at":"2026-08-07T04:58:44.571024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.647200Z","title":"Learning state representations with robotic priors,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.647200Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:c6ab6e7e0ad5d1d3525da7e22550df6f2aefb5c3ac54000e548ef9f1f39c8abf","observation_id":"ddee7633-09c5-41ca-ac4c-8f2167010cc2","resolution":{"observed_at":"2026-08-07T04:58:44.647200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.715651Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.715651Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:bffafb04112e654b1d0ee461c6d985b2d1ca8e18fc1524f2959d90c3803606dd","observation_id":"84773c6e-b52a-45bc-9697-0aa7af8612f9","resolution":{"observed_at":"2026-08-07T04:58:44.715651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.807451Z","title":"The theory of affordances,","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.807451Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f24e9bd65c4955502f60b07684904f9dafb02740343e685d7a89565a791ea353","observation_id":"eab956e4-f9d9-4873-b89f-0cd279c3ee3c","resolution":{"observed_at":"2026-08-07T04:58:44.807451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.902308Z","title":"Norman, The design of everyday things: Revised and expanded edition","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.902308Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:eb28ea3e375582845c65d86939fdb73dcc1cf48d5bee588fd244bea5537195b5","observation_id":"cb289901-aac1-4415-a2fd-840416977ec2","resolution":{"observed_at":"2026-08-07T04:58:44.902308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00878","last_updated":"2021-08-14T00:57:59Z","snapshot_observed_at":"2026-07-06T10:55:57.085122Z","submitted_at":"2021-04-02T04:18:53Z","title":"Contrastively Learning Visual Attention as Affordance Cues from Demonstrations for Robotic Grasping","version":3},"cited_work":{"arxiv_id":"2104.00878","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.00878","snapshot_observed_at":"2026-08-07T04:58:59.787333Z","title":"Contrastively Learning Visual Attention as Affordance Cues from Demonstrations for Robotic Grasping","venue":"cs.RO","work_id":"d664f8cd-3e7d-4d8c-b23a-3f25cd73d1ff","year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.009276Z"},"links":{"cited_paper":"/paper/2104.00878","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:bdb5fae70da4078e87f262d748c019305d100a645f99d1089ab9a29c0113a332","observation_id":"5bcaf4e7-ff37-4219-8cce-6c505bf3052b","resolution":{"observed_at":"2026-08-07T04:58:59.952682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.180106Z","title":"Self-supervised visual descriptor learning for dense correspondence,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.180106Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a4711fb65f1ae8a402c305579b720ba926fc1ddc6231239824f8daf8c60f2f9e","observation_id":"af89a593-db44-45ba-931d-46b71871e2f3","resolution":{"observed_at":"2026-08-07T04:58:45.180106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08756","last_updated":"2018-09-07T17:53:32Z","snapshot_observed_at":"2026-08-05T02:51:42.900972Z","submitted_at":"2018-06-22T16:38:01Z","title":"Dense Object Nets: Learning Dense Visual Object Descriptors By and For Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08756","snapshot_observed_at":"2026-08-07T04:58:45.337097Z","title":"Dense object nets: Learning dense visual object descriptors by and for robotic manipu- lation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.337097Z"},"links":{"cited_paper":"/paper/1806.08756","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:dc1e15bb7221767842dafe3efaf35b90d11bbab757ec8bc24d7bb2e077b2e113","observation_id":"31b503e7-d612-4b6f-92eb-46e297c14f94","resolution":{"observed_at":"2026-08-07T04:58:45.337097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.607094Z","title":"kpam: Keypoint affordances for category-level robotic manipulation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.607094Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9ca2f7b60ff44bc5871c7198f9001c8e573c455f9551fad66baf4936456b0db3","observation_id":"8b189007-d278-4c7e-a9e4-a207bea059a5","resolution":{"observed_at":"2026-08-07T04:58:45.607094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.753418Z","title":"Unsupervised learning of object key- points for perception and control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.753418Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:312fa4a15ea5c597b824015b03e8229dbf047b3209885d8572f29c0aa4e3335d","observation_id":"75531195-ff43-4430-bf1e-d7a098f0b1f2","resolution":{"observed_at":"2026-08-07T04:58:45.753418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.870214Z","title":"Keto: Learning keypoint representations for tool manipulation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.870214Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9bdcb5cb9ff519cabc7d36706ae90a71888f196c6ffa53e82c8112e871a93fcc","observation_id":"eb92a658-efb5-4168-ac6a-f941aead6c29","resolution":{"observed_at":"2026-08-07T04:58:45.870214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.964437Z","title":"Learning rope manipulation policies using dense object descriptors trained on synthetic depth data,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.964437Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d8cbcb59585087692931bc88a38f2d8f83620ad9d19c919608e53833c2c9d646","observation_id":"e6167ff1-e089-417a-818b-e08a47e9a6d0","resolution":{"observed_at":"2026-08-07T04:58:45.964437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.05085","last_updated":"2020-09-10T18:38:10Z","snapshot_observed_at":"2026-08-07T04:49:26.121536Z","submitted_at":"2020-09-10T18:38:10Z","title":"Keypoints into the Future: Self-Supervised Correspondence in Model-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.05085","snapshot_observed_at":"2026-08-07T04:58:46.127638Z","title":"Keypoints into the future: Self-supervised correspondence in model-based reinforcement learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.127638Z"},"links":{"cited_paper":"/paper/2009.05085","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:aafa1d7beb4ce5223fdbfafc90bf387b63156bb84bd2c268e82b819e799959c0","observation_id":"62845579-1b71-4cbd-93f7-5ba61f1acf45","resolution":{"observed_at":"2026-08-07T04:58:46.127638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.208571Z","title":"Unsupervised learning of visual 3d keypoints for control,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.208571Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:35352fa343bf3c1758dca0895f9886cf3aa2ff18429d017bd9ac65d2c2f71e08","observation_id":"c4709331-e432-4906-b13a-89224588015d","resolution":{"observed_at":"2026-08-07T04:58:46.208571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.366078Z","title":"Neural descriptor fields: Se (3)- equivariant object representations for manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.366078Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:772fa442a2722f3cd6782b48ef844e7fc5b3fe5321a26e530534133f09193516","observation_id":"a2b7d1aa-792a-49ce-a950-366fe7770b4c","resolution":{"observed_at":"2026-08-07T04:58:46.366078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.495487Z","title":"Se (3)-equivariant relational rearrangement with neural descriptor fields,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.495487Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:4ae818432e86699310de276379dda8e6c76cc04fd9edab64dea06387c268b4f6","observation_id":"046229ac-65d4-49b5-8dc5-18e1c2016a6f","resolution":{"observed_at":"2026-08-07T04:58:46.495487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15975","last_updated":"2023-08-31T15:29:44Z","snapshot_observed_at":"2026-08-02T05:52:28.378605Z","submitted_at":"2023-08-30T11:57:04Z","title":"RoboTAP: Tracking Arbitrary Points for Few-Shot Visual Imitation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15975","snapshot_observed_at":"2026-08-07T04:58:46.628203Z","title":"Robotap: Tracking arbitrary points for few-shot visual imitation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.628203Z"},"links":{"cited_paper":"/paper/2308.15975","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9357758a3f799a76882bb13ffbe11606bed82998df521533de9cd23d78e28662","observation_id":"08c75aba-1f5a-462a-a17e-db6ff134cfbc","resolution":{"observed_at":"2026-08-07T04:58:46.628203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.799301Z","title":"Local neural descriptor fields: Locally conditioned object represen- tations for manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.799301Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:53ed42013756fb3f2405c996a17bf90f09d31704bcb0630e0facda4147a2ab05","observation_id":"362749c5-09e4-474f-ba88-b7c7792bfc25","resolution":{"observed_at":"2026-08-07T04:58:46.799301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-07T04:58:46.936864Z","title":"Any-point trajectory modeling for policy learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.936864Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:112d20abd7b7e259ab0ba79a072e4c248dac33a3b81d5dd9b8a6a5cd69927930","observation_id":"65bfca8a-11c0-4bb8-b67a-6083fa6087ae","resolution":{"observed_at":"2026-08-07T04:58:46.936864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.100054Z","title":"Track2act: Predicting point tracks from internet videos enables diverse zero-shot robot manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.100054Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1039b3268827b964d38dc4aa4e072035be0f7fdd479c902b2be5c8bc6e249dba","observation_id":"39649e02-f077-4e1f-8b5b-7c3de42f0572","resolution":{"observed_at":"2026-08-07T04:58:47.100054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.261056Z","title":"An affordance keypoint detection network for robot manipulation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.261056Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:de6b099e03d30c89d3ecd72111f99787bc459ac7ba49351699748733d7ae6436","observation_id":"b703bcce-d429-41b3-958e-835982ce29ca","resolution":{"observed_at":"2026-08-07T04:58:47.261056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01652","snapshot_observed_at":"2026-08-07T04:58:47.369469Z","title":"Rekep: Spatio- temporal reasoning of relational keypoint constraints for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.369469Z"},"links":{"cited_paper":"/paper/2409.01652","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f47df9e37575bbf4b6f7b1e35ee1df865e1bc5da260abdfcc2a6f3f6e3da2357","observation_id":"f1461771-fcaa-4893-b5be-fa47ac2586dc","resolution":{"observed_at":"2026-08-07T04:58:47.369469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.445162Z","title":"Affordance detection of tool parts from geometric features,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.445162Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:ebebf32954434e3a393c827afe7d53e87150fe35bc0fda97e2cac03b911371b0","observation_id":"34884d01-2631-4290-9ba7-571277ae32d1","resolution":{"observed_at":"2026-08-07T04:58:47.445162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.521498Z","title":"Affordance detection for task-specific grasping using deep learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.521498Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f05c276a69d692445e426d8fd4d5b2d28c9fb3fccf29320f8c142dfa6041ffe8","observation_id":"898f8bda-842e-4b37-8f9d-bfbec3f46b91","resolution":{"observed_at":"2026-08-07T04:58:47.521498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.599031Z","title":"Object-based affordances detection with convolutional neural net- works and dense conditional random fields,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.599031Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:2212a15876f862ee514e0d4c00ee158dd4ed938faea38ae41da6f9f90b59ef49","observation_id":"a46c268c-89fc-4090-ab79-236372b9e7c0","resolution":{"observed_at":"2026-08-07T04:58:47.599031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.704460Z","title":"Affordancenet: An end-to-end deep learning approach for object affordance detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.704460Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:0f4502840cbf1e9fe5bf0347148dee0e47ce3ca0bb04f7c8c44d6c5ed8386c3f","observation_id":"762202d1-d371-484f-95aa-85e19c20bb9d","resolution":{"observed_at":"2026-08-07T04:58:47.704460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.896212Z","title":"Toward affordance detection and ranking on novel objects for real-world robotic manip- ulation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.896212Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a2fd3f7d2db757c97e50cf7e565e39425a3270e0af3198d6512770fdf2ba1770","observation_id":"40121d3e-509a-40b4-b30d-02dc754a00c7","resolution":{"observed_at":"2026-08-07T04:58:47.896212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.049614Z","title":"Learning dexterous grasping with object-centric visual affordances,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.049614Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:e9c67d76d510d9dcb4aa86cd2c7761f1a1a9e9d2192e116589d1f1bc8b98cfd9","observation_id":"ae2a15ce-b5bb-4875-bfce-48669aa85b37","resolution":{"observed_at":"2026-08-07T04:58:48.049614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.164305Z","title":"Affordance learning for end-to-end visuomotor robot control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.164305Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1f7f29db5a21ec85a9176eadf5a5bc1d418f177b542eaddb78560ee0317b0d32","observation_id":"cf50cacb-9ed4-4bee-b130-993bd2beba3a","resolution":{"observed_at":"2026-08-07T04:58:48.164305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.250001Z","title":"Affordance learning from play for sample-efficient policy learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.250001Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:b750c81d82b4ab911b48e54face2dc0fb8d9b91905fa590879dcb81d95ac1566","observation_id":"29c7450f-8d75-479b-9fa6-ba481f2b20d7","resolution":{"observed_at":"2026-08-07T04:58:48.250001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.382280Z","title":"Visual affordance pre- diction for guiding robot exploration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.382280Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:963542fd1b0679cb517dcf4194f72acf08fdadc38041f0349ee101bb83c3281b","observation_id":"c23841ac-e208-4f35-b0f5-ea74122bd413","resolution":{"observed_at":"2026-08-07T04:58:48.382280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18911","last_updated":"2024-07-26T17:59:52Z","snapshot_observed_at":"2026-07-06T18:52:34.247456Z","submitted_at":"2024-07-26T17:59:52Z","title":"HRP: Human Affordances for Robotic Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18911","snapshot_observed_at":"2026-08-07T04:58:48.482260Z","title":"Hrp: Human af- fordances for robotic pre-training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.482260Z"},"links":{"cited_paper":"/paper/2407.18911","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:e77f7ccbd20faeb823b1608a752f07500f9f07b3cee2a06ffcf5c1cf8f7d819c","observation_id":"f153e561-133b-454d-85e7-b83de4f01ad6","resolution":{"observed_at":"2026-08-07T04:58:48.482260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.617921Z","title":"Learning relational affordance models for robots in multi-object manipulation tasks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.617921Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:45d435ca41ba999acf7afcfbd2e68d0a2620a5b04142796d207cc5c6d7b29503","observation_id":"b8ce8ea2-8810-4578-ad5d-f9ba4f7f4f18","resolution":{"observed_at":"2026-08-07T04:58:48.617921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.707660Z","title":"Affordance-based grasping and manipulation in real world applications,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.707660Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d589950d6654793be7b7f4a43e12c5e431bf0401dee5350e7b6ce23a97612378","observation_id":"b012a899-417e-481b-a26d-1a518759dfe7","resolution":{"observed_at":"2026-08-07T04:58:48.707660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.781486Z","title":"Robotic pick-and-place of novel objects in clutter with multi-affordance grasping and cross- domain image matching,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.781486Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:23f396225a637249735b52be0d24c42ff112862bd0c4794d80d9b372130d3461","observation_id":"02107307-a024-4cb4-a64b-bf9a40c915a6","resolution":{"observed_at":"2026-08-07T04:58:48.781486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.869424Z","title":"Metagrasp: Data efficient grasping by affordance interpreter network,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.869424Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1e1ed99552bebc72180241a5528036d0da7abbe65fe61fdb209ddf569a0ffa17","observation_id":"4c791151-5b18-406d-88ae-1c10ffc337ae","resolution":{"observed_at":"2026-08-07T04:58:48.869424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.971088Z","title":"Learning affordance space in physical world for vision-based robotic object manipulation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.971088Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:eb291cc8ddb98c1b1611047a7c8e9b4ebd17df4cef9dd08cebaa5ec9685a8c64","observation_id":"3970c5a5-3ac6-4d1a-ab29-608314cf3452","resolution":{"observed_at":"2026-08-07T04:58:48.971088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.052562Z","title":"Learning multi- object dense descriptor for autonomous goal-conditioned grasping,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.052562Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:01e1e2866cfb952870f29d601cafc0d06444ccd473c6208e7b5fdaf3d8cb4d28","observation_id":"8285cf01-6602-43d6-aaaa-3c9c59c3bf2e","resolution":{"observed_at":"2026-08-07T04:58:49.052562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.196742Z","title":"Deep affordance foresight: Planning through what can be done in the future,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.196742Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:6a00ee3f14cc4bf91f5b50cb15142adff48910c818c5151e13efd16067b8bafb","observation_id":"fd05c41d-a50c-4561-8d68-8a8efd295ad1","resolution":{"observed_at":"2026-08-07T04:58:49.196742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.317670Z","title":"Where2act: From pixels to actions for articulated 3d objects,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.317670Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:2bb484a3468abf2922321bfac795ba57f1bf996f141220100eb3191ba3a13931","observation_id":"d236ac2e-d78a-4397-a83d-a8604444a8e5","resolution":{"observed_at":"2026-08-07T04:58:49.317670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-07T04:58:49.482082Z","title":"Do as i can and not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.482082Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f77e503da70609b114cfd9cc672473ae604d39ffa568de80d4480c836e53fb1e","observation_id":"ab0ee92c-2cc0-4092-b626-807e5d2059c9","resolution":{"observed_at":"2026-08-07T04:58:49.482082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01911","last_updated":"2023-03-08T11:00:55Z","snapshot_observed_at":"2026-08-07T01:47:59.265318Z","submitted_at":"2022-10-04T21:16:48Z","title":"Grounding Language with Visual Affordances over Unstructured Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01911","snapshot_observed_at":"2026-08-07T04:58:49.567636Z","title":"Grounding language with visual affordances over unstructured data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.567636Z"},"links":{"cited_paper":"/paper/2210.01911","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:4c98603c6795166a143be2dc3460e3bf8962b4108acdce8e3b399f9dcf9d0fae","observation_id":"b1ddd6cd-2c1e-4353-8fb9-accd83001d87","resolution":{"observed_at":"2026-08-07T04:58:49.567636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.666570Z","title":"Learning generalizable dexterous manipulation from human grasp affordance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.666570Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:e3398d1bc24e96023697d70ea481580dee96c942f6fc6e81e86e55bc2ee78447","observation_id":"277cdb4a-ca8b-442e-b3f0-84faf4a275b9","resolution":{"observed_at":"2026-08-07T04:58:49.666570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.775313Z","title":"Learning affordance grounding from exocentric images,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.775313Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:2cd473c078b07bbde81bdf8fa460d6fad98bc7fc7894455fc5709133f3ed843a","observation_id":"09076003-937e-43be-9949-66c444b7c9b2","resolution":{"observed_at":"2026-08-07T04:58:49.775313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.889545Z","title":"Locate: Localize and transfer object parts for weakly supervised affordance grounding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.889545Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f70af5b888ed4355e8a3471e9645c3af13a67df69c436cd3258aab01bebf78ba","observation_id":"7606ed3e-3e38-4ba8-928e-8b8bbf197f45","resolution":{"observed_at":"2026-08-07T04:58:49.889545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:50.021030Z","title":"Affordpose: A large- scale dataset of hand-object interactions with affordance-driven hand pose,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.021030Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:93201729ae5d4467acf4654cec08dd26844bb297f0013ea9c063d54181dbc6c7","observation_id":"03475642-ee76-4a98-8112-518133140a07","resolution":{"observed_at":"2026-08-07T04:58:50.021030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:50.183998Z","title":"3d affordancenet: A benchmark for visual object affordance understanding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.183998Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:c831d1d99ace0cfec479fc325ca13c5491440645b1d97b22ce69576c58aab45d","observation_id":"d9d4058e-15ec-4374-8b99-4ac8ca178378","resolution":{"observed_at":"2026-08-07T04:58:50.183998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.14973","last_updated":"2021-06-28T20:43:35Z","snapshot_observed_at":"2026-07-06T11:23:56.887244Z","submitted_at":"2021-06-28T20:43:35Z","title":"GIFT: Generalizable Interaction-aware Functional Tool Affordances without Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.14973","snapshot_observed_at":"2026-08-07T04:58:50.356269Z","title":"Gift: Generalizable interaction-aware functional tool affordances without labels,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.356269Z"},"links":{"cited_paper":"/paper/2106.14973","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:6f5ec0b136cb1616d1218f48f79d22dd15656eef7b91aea1f02ca1c6f126ac98","observation_id":"2f03fc6a-70b4-4c67-b990-e79d022a2f99","resolution":{"observed_at":"2026-08-07T04:58:50.356269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03380","last_updated":"2021-11-11T19:06:52Z","snapshot_observed_at":"2026-08-08T00:23:32.174067Z","submitted_at":"2021-07-07T17:59:07Z","title":"RRL: Resnet as representation for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03380","snapshot_observed_at":"2026-08-07T04:58:50.507923Z","title":"Rrl: Resnet as representation for reinforce- ment learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.507923Z"},"links":{"cited_paper":"/paper/2107.03380","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:414efac311fbc47872f03599c05a3a80a11fcb03d5e4738a0e35c73aa2d06f1b","observation_id":"781c4177-2bf8-4c71-9548-8112df7bae7d","resolution":{"observed_at":"2026-08-07T04:58:50.507923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01511","last_updated":"2021-12-06T16:46:37Z","snapshot_observed_at":"2026-07-06T12:14:49.815939Z","submitted_at":"2021-12-02T18:58:09Z","title":"The Surprising Effectiveness of Representation Learning for Visual Imitation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01511","snapshot_observed_at":"2026-08-07T04:58:50.652147Z","title":"The sur- prising effectiveness of representation learning for visual imitation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.652147Z"},"links":{"cited_paper":"/paper/2112.01511","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f7f6fd438b1d8f389bb0b74a8c5299fc4ed062ea49b0ff612784e40256f10dc0","observation_id":"0ec3b6d5-215b-4888-8615-1ab1c77f80b7","resolution":{"observed_at":"2026-08-07T04:58:50.652147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:50.782536Z","title":"The unsurprising effectiveness of pre-trained vision models for control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.782536Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:def7301ec7240f9ee349a7823776d1cab0d333706df9c01d836225ed9b23bb44","observation_id":"17f43029-cc7c-4451-97c5-be6fe8275061","resolution":{"observed_at":"2026-08-07T04:58:50.782536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06173","last_updated":"2022-03-11T18:58:10Z","snapshot_observed_at":"2026-08-06T13:06:27.360959Z","submitted_at":"2022-03-11T18:58:10Z","title":"Masked Visual Pre-training for Motor Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06173","snapshot_observed_at":"2026-08-07T04:58:50.924401Z","title":"Masked visual pre- training for motor control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.924401Z"},"links":{"cited_paper":"/paper/2203.06173","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9e188c0410f3ab1c9d38895376d4eba393bf8432c2a7bc9052373a10594ceaac","observation_id":"3da5337c-0210-42f4-ba89-2f6e58a19f2d","resolution":{"observed_at":"2026-08-07T04:58:50.924401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:51.094252Z","title":"Real-world robot learning with masked visual pre-training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.094252Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:8b4b74e9a0709d2fe15e7f9f00f3370bc484abd8c85c5c16c9b9390f03ee07f0","observation_id":"2ba4dd18-59b0-432c-8c06-892b0e3577da","resolution":{"observed_at":"2026-08-07T04:58:51.094252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-02T00:17:16.761436Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-07T04:58:51.297606Z","title":"Vip: Towards universal visual reward and representation via value-implicit pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.297606Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:94ef16e9a652e78b3325622e3c3301d2ee755c56d1bfec73c9284261e1c9d703","observation_id":"168fa19c-c39b-4fd3-91ba-5a5495ae9509","resolution":{"observed_at":"2026-08-07T04:58:51.297606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:51.450409Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.450409Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:6f4e8adf2fc12d1f02fe8bcf65998467ae8a4025a0f3c8c5ab03ddf24e29f9f6","observation_id":"7c8e226f-2a71-4d67-918c-68831c562caf","resolution":{"observed_at":"2026-08-07T04:58:51.450409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12444","last_updated":"2023-11-03T18:09:08Z","snapshot_observed_at":"2026-08-07T19:29:49.767397Z","submitted_at":"2023-11-03T18:09:08Z","title":"What Makes Pre-Trained Visual Representations Successful for Robust Manipulation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12444","snapshot_observed_at":"2026-08-07T04:58:51.628421Z","title":"What makes pre-trained visual representations successful for robust manipulation?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.628421Z"},"links":{"cited_paper":"/paper/2312.12444","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a1350219b5485606cade23f158ec1f365ca12093902acf8bc004508ae34ec2af","observation_id":"b4b153d4-0a61-4d9e-b513-388c100d7c3f","resolution":{"observed_at":"2026-08-07T04:58:51.628421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:51.721888Z","title":"Offline visual represen- tation learning for embodied navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.721888Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:0918903b161e5f812537dcdbbfcc5141747e75da20c90c7c3e48bf016c5a504b","observation_id":"f34737fc-71d5-4eb4-af7c-62dd024ddbb8","resolution":{"observed_at":"2026-08-07T04:58:51.721888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-02T11:48:59.131827Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-07T04:58:51.906420Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.906420Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:8ac6e18a2aef150316711e58400488d4e0f81a5db652fc12c120a7676591c982","observation_id":"960851e6-defb-451b-bcef-81884104afa2","resolution":{"observed_at":"2026-08-07T04:58:51.906420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12766","last_updated":"2023-02-24T17:29:31Z","snapshot_observed_at":"2026-08-05T20:49:12.236475Z","submitted_at":"2023-02-24T17:29:31Z","title":"Language-Driven Representation Learning for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12766","snapshot_observed_at":"2026-08-07T04:58:52.096173Z","title":"Language-driven representation learning for robotics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.096173Z"},"links":{"cited_paper":"/paper/2302.12766","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9cbe53a403cd60b29abc38392a03ed27139474b857703f03556e7e417f868f8a","observation_id":"1eba31b4-7702-4fa7-92a2-68d39581b209","resolution":{"observed_at":"2026-08-07T04:58:52.096173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:52.271406Z","title":"Liv: Language-image representations and rewards for robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.271406Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:332e683d507fbf327832aec356e1329189cf2c690478ba81d5c831d97485ae28","observation_id":"0035884c-289e-4e54-b2e5-46a31acf3de3","resolution":{"observed_at":"2026-08-07T04:58:52.271406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:52.402855Z","title":"Simple but effective: Clip embeddings for embodied ai,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.402855Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:62e17ca76f170e238a20298c1c6e40a8f2c0eb17605f06c3b60612e51dcda7c4","observation_id":"1dffb014-20d6-4ff4-b171-f53a5e01ad6c","resolution":{"observed_at":"2026-08-07T04:58:52.402855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:04.084624Z","title":"Can foundation models perform zero-shot task specification for robot manipulation?","venue":null,"work_id":"d551d49f-9d0d-4415-816a-a718dc337abd","year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.520738Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:7bb8a00a3dba790d9679be422f602b439db1225cc3004ef167661c67b41065de","observation_id":"b9d61ca8-86ce-4473-82bf-2a4c10d74ec2","resolution":{"observed_at":"2026-08-07T04:59:04.169964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.926476Z","title":"Cliport: What and where pathways for robotic manipulation,","venue":null,"work_id":"5f47c711-4a0f-4b04-9b48-47d145870977","year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.576876Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:74d548bc9d64cc0ed63769c1034cb59ad46bb8392ee690a022e744a50ec23f92","observation_id":"55851907-02d3-4937-9092-64624485edbd","resolution":{"observed_at":"2026-08-07T04:59:04.002602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.777545Z","title":"Spawnnet: Learning generalizable visuomotor skills from pre-trained network,","venue":null,"work_id":"7a240040-045e-4d92-a40d-20e65f34c7bd","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.659184Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:61885765577482d4bb60018b2aa451851eb21db8bbab60463a3fc9f47000d6e8","observation_id":"e918e6f7-52a9-4835-96fd-c42b9129e3dd","resolution":{"observed_at":"2026-08-07T04:59:03.854511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.644375Z","title":"GenDP: 3d semantic fields for category-level generalizable diffusion policy,","venue":null,"work_id":"d0702118-e6bc-4d71-8743-ece0f04063a9","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.744717Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:720c02bdfa7d9da4f4e9d263181acadeb848801aacac6ef7ef023705328cdd7a","observation_id":"a52aad4e-5e76-44ac-a4d1-c34c65cb6eb8","resolution":{"observed_at":"2026-08-07T04:59:03.714794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22325","last_updated":"2024-10-30T03:33:08Z","snapshot_observed_at":"2026-07-06T19:41:46.397542Z","submitted_at":"2024-10-29T17:58:13Z","title":"Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22325","snapshot_observed_at":"2026-08-07T04:58:52.920607Z","title":"Robots pre-train robots: Manipulation-centric robotic representation from large-scale robot datasets,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.920607Z"},"links":{"cited_paper":"/paper/2410.22325","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:949cc81272ef8ee6dee6ccaad6fb93092cc8917000893a922f1c6836edaa7398","observation_id":"f967932b-d908-4fc6-8bc9-2335c91f3037","resolution":{"observed_at":"2026-08-07T04:58:52.920607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:53.028914Z","title":"Otter: A vision-language-action model with text-aware visual feature extraction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.028914Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:68bcd0d155137e0faf12a0a1c08eb461f7db0a1332aa1c5844e516ec742e53bf","observation_id":"1a770ebd-471e-48d7-bb2c-63f0d92aafb2","resolution":{"observed_at":"2026-08-07T04:58:53.028914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.484015Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms,","venue":null,"work_id":"2a9ce6d0-3fff-438f-bf3d-e82a329addbc","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.116398Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:b3819f87146a36fe50fa14978c15bceb319afd712142394764d133efa231b357","observation_id":"9b015a26-9eab-4b09-ab92-d10730fb916a","resolution":{"observed_at":"2026-08-07T04:59:03.552760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.333109Z","title":"Winoground: Probing vision and language models for visio-linguistic compositionality,","venue":null,"work_id":"2870ae79-2337-438d-b079-2e9ee789b3cb","year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.185987Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9db814e6dd17d816ef7d9d9a54e6856b279d40a623142120c80a7047026cedae","observation_id":"6097c010-d01f-4301-bab4-b3ae464669e7","resolution":{"observed_at":"2026-08-07T04:59:03.401089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.184505Z","title":"When and why vision-language models behave like bags-of-words, and what to do about it?","venue":null,"work_id":"7ec426ac-07ec-4581-b9a6-b165f7fcb914","year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.298491Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:72af82b1db74023f0a8d03af7d55693c74260318443f6011b45e0a69ded890ce","observation_id":"4fc9eb35-f6f9-44eb-928d-53a2da57c95b","resolution":{"observed_at":"2026-08-07T04:59:03.255481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.068641Z","title":"Sugarcrepe: Fixing hackable benchmarks for vision-language com- positionality,","venue":null,"work_id":"560b5315-65cf-4910-92d5-99d20cdb3195","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.393018Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:6eb1648c2e14842edb8caeac34af5dc2ce9e037ea03ac289c4e13e1d79ba99bc","observation_id":"6b3b1b70-27e1-4782-ad42-2c332e9f47d9","resolution":{"observed_at":"2026-08-07T04:59:03.113881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08782","last_updated":"2024-10-01T08:54:53Z","snapshot_observed_at":"2026-07-06T17:01:35.415575Z","submitted_at":"2023-12-14T10:02:55Z","title":"Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08782","snapshot_observed_at":"2026-08-07T04:58:53.446033Z","title":"Toward general-purpose robots via foundation models: A survey and meta-analysis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.446033Z"},"links":{"cited_paper":"/paper/2312.08782","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1720fa3e329338bc6619769c535d0f22d41baff91e56c4a0fd0feb50df8fbb6c","observation_id":"711095f9-707b-4ef9-a73c-36d951d0a4f5","resolution":{"observed_at":"2026-08-07T04:58:53.446033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07843","last_updated":"2023-12-13T02:20:42Z","snapshot_observed_at":"2026-07-06T17:00:53.532910Z","submitted_at":"2023-12-13T02:20:42Z","title":"Foundation Models in Robotics: Applications, Challenges, and the Future","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07843","snapshot_observed_at":"2026-08-07T04:58:53.510632Z","title":"Foundation models in robotics: Applications, challenges, and the future,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.510632Z"},"links":{"cited_paper":"/paper/2312.07843","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:189177390c4bb4d91c138aac20cb224979e1211f71f09d9daf54be7769ea766c","observation_id":"5c2bc97e-5099-4d5f-a048-f7d04c57ed39","resolution":{"observed_at":"2026-08-07T04:58:53.510632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05741","last_updated":"2024-10-23T03:39:00Z","snapshot_observed_at":"2026-07-06T17:27:29.050237Z","submitted_at":"2024-02-08T15:19:50Z","title":"Real-World Robot Applications of Foundation Models: A Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05741","snapshot_observed_at":"2026-08-07T04:58:53.560629Z","title":"Real-world robot applications of foundation models: A review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.560629Z"},"links":{"cited_paper":"/paper/2402.05741","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:36420a22abcef06ab6406cafb939460a57adc1309101e250d6800027192e3775","observation_id":"76fa5d92-a3ce-4484-b69b-8f9b89d44e92","resolution":{"observed_at":"2026-08-07T04:58:53.560629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04129","last_updated":"2023-03-07T18:44:07Z","snapshot_observed_at":"2026-08-03T19:24:56.017408Z","submitted_at":"2023-03-07T18:44:07Z","title":"Foundation Models for Decision Making: Problems, Methods, and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04129","snapshot_observed_at":"2026-08-07T04:58:53.629901Z","title":"Foundation models for decision making: Problems, methods, and opportunities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.629901Z"},"links":{"cited_paper":"/paper/2303.04129","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:bacddee971f1b1b8713921a44d8f3c6fe896cd86c9d5a9716e7d63d94d4281b5","observation_id":"e93e8ece-734e-48d8-ac24-14f4972fb4fd","resolution":{"observed_at":"2026-08-07T04:58:53.629901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08248","last_updated":"2024-03-13T05:03:58Z","snapshot_observed_at":"2026-08-02T02:09:06.312626Z","submitted_at":"2024-03-13T05:03:58Z","title":"CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08248","snapshot_observed_at":"2026-08-07T04:58:53.681208Z","title":"Copa: General robotic manipulation through spatial constraints of parts with foun- dation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.681208Z"},"links":{"cited_paper":"/paper/2403.08248","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9e26dca36722397ead52250166a562531cebabaf09c538fca9b2d455e41a3c55","observation_id":"05e3e450-66f9-4da2-bb16-59a5c5e6eafd","resolution":{"observed_at":"2026-08-07T04:58:53.681208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03174","last_updated":"2024-09-04T01:18:13Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:08:45Z","title":"MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03174","snapshot_observed_at":"2026-08-07T04:58:53.781859Z","title":"Moka: Open-vocabulary robotic manipulation through mark-based visual prompting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.781859Z"},"links":{"cited_paper":"/paper/2403.03174","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:925235ec614a90f8eef0d64ae0be4c10d12b8fd295004275291ff052a377f58a","observation_id":"9650ecbe-c9d9-45a7-b74f-d7da9e6b17ae","resolution":{"observed_at":"2026-08-07T04:58:53.781859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07872","last_updated":"2024-02-12T18:33:47Z","snapshot_observed_at":"2026-08-02T06:03:03.152035Z","submitted_at":"2024-02-12T18:33:47Z","title":"PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07872","snapshot_observed_at":"2026-08-07T04:58:53.856037Z","title":"Pivot: Iterative visual prompting elicits actionable knowledge for vlms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.856037Z"},"links":{"cited_paper":"/paper/2402.07872","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:ce666782ce3d58b10132b64e692910764427b59eaf536a74970a7c9fe8417776","observation_id":"e5c1427f-7675-42e3-8e7c-fe077f9071ec","resolution":{"observed_at":"2026-08-07T04:58:53.856037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17842","last_updated":"2023-12-24T03:48:40Z","snapshot_observed_at":"2026-08-07T02:37:30.672574Z","submitted_at":"2023-11-29T17:46:25Z","title":"Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17842","snapshot_observed_at":"2026-08-07T04:58:53.946964Z","title":"Look before you leap: Unveiling the power of gpt-4v in robotic vision-language planning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.946964Z"},"links":{"cited_paper":"/paper/2311.17842","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9026f992d662ab8f31e4e7654cb5f5568e117f8e56f15edd1df90f16084ab0c0","observation_id":"f7a13579-681a-48dd-9bce-fc3b01b1feea","resolution":{"observed_at":"2026-08-07T04:58:53.946964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10625","last_updated":"2023-10-16T17:48:45Z","snapshot_observed_at":"2026-07-06T16:34:04.003157Z","submitted_at":"2023-10-16T17:48:45Z","title":"Video Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10625","snapshot_observed_at":"2026-08-07T04:58:54.032686Z","title":"Video language planning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.032686Z"},"links":{"cited_paper":"/paper/2310.10625","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:2027afcdc6235d66fe1c15da23f3914323a1deb1c1136fb324c9343346fc6bb7","observation_id":"212b8b0c-8cee-4d8d-9395-ed48d4d60a43","resolution":{"observed_at":"2026-08-07T04:58:54.032686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:54.106707Z","title":"3d-llm: Injecting the 3d world into large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.106707Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:defdf87885ee0b483a97a19dad001792e335263bc44c9ea4f92b0b5a44dff974","observation_id":"bf6f62ab-99f5-4a2a-b8b4-01ab94f7d42b","resolution":{"observed_at":"2026-08-07T04:58:54.106707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:54.198673Z","title":"Spatialvlm: Endowing vision-language models with spatial reasoning capabilities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.198673Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:68c03edba5b39849e0ebe5cdd5f5c03a10d7f6b1deb7a807b178e051a9fc2f14","observation_id":"e1a5d62c-6a73-4296-9ebb-969f44d1c380","resolution":{"observed_at":"2026-08-07T04:58:54.198673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-07T04:58:54.287250Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.287250Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9df11c3bd419cc2895fcee500dfabe16a05a9f1be2cadbd8a17611b44f0bd5d8","observation_id":"93201b58-411a-462f-a005-259eef537302","resolution":{"observed_at":"2026-08-07T04:58:54.287250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T04:58:54.362866Z","title":"Rt-2: Vision- language-action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.362866Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:39e7088f0d7c060ad7a9fb9cbced8818707db9622f1dadd4d59339c5a0233fb0","observation_id":"fc97f1a8-e40b-48ed-a702-05e50757c3c4","resolution":{"observed_at":"2026-08-07T04:58:54.362866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02561","last_updated":"2024-03-03T08:12:36Z","snapshot_observed_at":"2026-07-06T16:14:56.479402Z","submitted_at":"2023-09-05T20:21:03Z","title":"Physically Grounded Vision-Language Models for Robotic Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02561","snapshot_observed_at":"2026-08-07T04:58:54.442710Z","title":"Physically grounded vision-language models for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.442710Z"},"links":{"cited_paper":"/paper/2309.02561","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:c41bd7497bcc45536b0d7e714e213cbbe5b567e5aa59bf8c4433ee99d4dc499b","observation_id":"c35d9411-e81c-49cf-b1e6-df87bda53714","resolution":{"observed_at":"2026-08-07T04:58:54.442710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T04:50:00.649007Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":91,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":135},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 6 inbound Pith citation observations for arXiv:2506.09284."}