{"as_of":"2026-08-16T14:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc82855727ef5703e307d043f90cf7e8684f6b89689e35d7a74820d6ed69a897","coverage":[{"denominator":106,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T14:13:13.043886Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.02551/citation-record","integrity":"/paper/2606.02551/integrity","json":"/paper/2606.02551/citation-record.json","paper":"/paper/2606.02551"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-16T04:42:52.370966Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":"2503.06669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-07-10T23:07:47.895730Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","venue":"cs.RO","work_id":"f797e9ec-510f-43a7-8a0c-18009ce332e5","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:a5dbee208acffa8d28d7b2431cb191e48428568e405e4233f68b9a3bca627ea0","observation_id":"26b56391-4fe7-4a03-90fb-f94f533106f1","resolution":{"observed_at":"2026-07-01T23:36:22.841587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Affordances from human videos as a versatile representation for robotics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:109369e2167de978c568347b2c9c2422469d085d21070ed82a8b2b58b720f2fc","observation_id":"f6d414d2-4b85-4045-b3f7-915538f3bd2f","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:8c45e06969789ec5e1455534f1d4877bc4f016a4da94611633df5a09bb4beb10","observation_id":"84bc78b2-7689-46cc-9b05-2088927a271a","resolution":{"observed_at":"2026-07-01T23:36:22.849506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"HOT3D: Hand and object tracking in 3D from egocentric multi-view videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:c073d30a36b903c19231ff70f6a65ae4b23a1d02f5db65a49424db714e939724","observation_id":"0fe6e695-4b65-4063-8a98-e8e586feb406","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Track2Act: Predicting point tracks from internet videos enables generalizable robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:48874d5c0219a58beaf271f6c68d155fea4b6fdd560cff3a7fc5ba48e6cb9777","observation_id":"a0db5fd9-2f34-4b33-a25a-ec953f53216c","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.2024","doi":"10.1109/ictai62512.2024.00120","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"— IEEE","venue":null,"work_id":"85edbdcf-ebfb-4a4b-8aa4-7d26e7f21a1f","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:100308854026b9857c29ef9945c82cfd4779c5a6f4c563bd96701a24cff308a3","observation_id":"1d141317-78ea-421c-bba5-4837376d6d88","resolution":{"observed_at":"2026-06-28T14:22:18.451309Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"VidBot: Learning generalizable 3D actions from in-the-wild 2D human videos for zero-shot robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:a9618ded9b4ba269f06183c39610d8f6aa1d398d0aa9c912ceb6b11cacee90d9","observation_id":"b10be412-34f5-4961-8a81-24a6db2ebf0b","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"G3Flow: Generative 3D semantic flow for pose-aware and generalizable object manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:98db0f0573ba79ffe4d127dbf0c42a1b94ed000252906fbfaaa267041f4f0532","observation_id":"1fdf7b90-ba27-4124-891d-7bb98e0231c5","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"3d-affordancellm: Harnessing large language models for open-vocabulary affordance detection in 3d worlds","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:9b30ad9bc221486cdee0cad7c92fff8c1091c2bb31906ab81e135b9f3d5c2bf3","observation_id":"1bb594e8-53d4-4465-8df6-6e0e34a07a51","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"GanHand: Predicting human grasp affordances in multi-object scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:12932104561de23b6c079ed1df3da4d1d0e8cc4d477cc1e2e8136ac62a81afe9","observation_id":"700ce1bf-a673-4bc7-88d8-d6ecab4c7264","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Rescaling egocentric vision: Collection, pipeline and challenges for EPIC-KITCHENS-100","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:c387f6a0c4b8776c196921be3139a0cc7fd88922bcca9fd0b5bdbf241538bfaa","observation_id":"0d19eac0-1ec0-42ac-a770-606ef1b8f0a5","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"SceneFun3D: Fine-grained functionality and affordance understanding in 3D scenes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:e6570689995dcf8e283fd950d30f498b833f52ad04e5399a44235d495ba5c665","observation_id":"e6131330-580c-4317-bdf4-77fc2d849823","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"3d affordancenet: A benchmark for visual object affordance understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:5a7ce99b16848b1bde928a1effbb6cffde88a1a5f993dc10d3faeeae5159ccfc","observation_id":"f285fa28-b06a-498e-87a6-07f3ad1bce4f","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Affordancenet: An end-to-end deep learning ap- proach for object affordance detection","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:fe2594da6719ee5166e4d0869f1becbc405012be4c1da80467d71177aa025af0","observation_id":"7e851b65-5cb6-4bcd-b4c7-190b9fb4f7ae","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2022.xviii.018","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Eisner, H","venue":null,"work_id":"3fcd8d50-8e55-4d5d-b40a-26a417daddd6","year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:f1a98eed231ad03c4f15ec014400380a3d0d07b8e4b91fc1e9a147afacc69c4d","observation_id":"93b7695d-ce97-4764-b80f-9ba0a557b8be","resolution":{"observed_at":"2026-06-28T14:22:18.474599Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00595","last_updated":"2023-09-26T10:47:35Z","snapshot_observed_at":"2026-08-13T11:04:17.407514Z","submitted_at":"2023-07-02T15:33:31Z","title":"RH20T: A Comprehensive Robotic Dataset for Learning Diverse Skills in One-Shot","version":2},"cited_work":{"arxiv_id":"2307.00595","doi":"10.48550/arxiv.2307.00595","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.00595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RH20T: A comprehensive robotic dataset for learning diverse skills in one-shot","venue":"arXiv (Cornell University)","work_id":"d0404087-2d28-482f-8b50-8400d35d315e","year":2023},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2307.00595","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:1205e649ff0a682fc37e56978c1f86f60d3b2b2af889edeccbbb016a8053913b","observation_id":"6c6f44e9-1c22-4b52-a550-3168892f722c","resolution":{"observed_at":"2026-07-01T23:36:22.837870Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.328115","doi":"10.1109/tro.2023.3281152","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Near-optimal multi-robot motion planning with finite sampling,","venue":"IEEE Transactions on Robotics","work_id":"a4f7470e-790b-4782-8c26-abf93cf16a1c","year":2023},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:179b5e4c0e7ef084e6fb6727e0b71c872bd812025a6a7029a66134cf05863604","observation_id":"4be2939d-d156-4188-b410-5d85096fb436","resolution":{"observed_at":"2026-06-28T14:22:18.477174Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/14702540801897809","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Poles of inaccessibility: A calculation algorithm for the remotest places on earth","venue":"Scottish Geographical Journal","work_id":"61232492-d5f1-4656-b27f-0d6ced28ab1f","year":2007},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:9009509cdf86ab721db45308018803da1b4a42a0c77ea03794b2b2d070753c31","observation_id":"775f7587-70f9-4521-8607-e9ea9bf28ce6","resolution":{"observed_at":"2026-06-28T14:22:18.479124Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Gibson.The Ecological Approach to Visual Perception","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:3118f69f3994fdafa4a80cca17e2d6d179c9eab530c15ddb87df3a45811b9598","observation_id":"cd3900ba-62ba-49a5-8bfb-e7d7f2c48cde","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Ego4D: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:18e0e55f29cd21b9aa184a6c94a2a2b80d9427bf4a458680b514251a2e3054da","observation_id":"e4509e00-6c57-47d1-b169-d956c2aae01c","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.08246","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T23:36:22.830513Z","title":"Fsag: Enhancing human-to-dexterous-hand finger-specific affordance grounding via diffusion models, 2026","venue":null,"work_id":"11075b33-d623-4855-b333-d103b1901ec0","year":2026},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:d3a73d489bd21ce45ca6fb477cbb7860dde23b64a684686742901fa999af1ba8","observation_id":"b8eed7a6-973b-4536-95fe-2a3747a86d53","resolution":{"observed_at":"2026-07-01T23:36:22.833015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.12436","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T06:07:41.256835Z","title":"Roboafford++: A generative ai-enhanced dataset for multimodal affordance learning in robotic manipulation and navigation","venue":null,"work_id":"4f34c0bf-7647-4732-ba40-6ceafc32ea7c","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:e78d8576edd92628322b6329e346abb5da33ea7a7f51dc895511653ebacc1276","observation_id":"7c86a5da-1559-4e9c-9c4a-ca1522cf23ae","resolution":{"observed_at":"2026-07-01T23:36:22.812088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"2handedafforder: Learning precise actionable bimanual affordances from human videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:0ecee0348bbdb71350475fdfebb95332b8659787325f240152b8f82d1a1b910f","observation_id":"7b122928-2de5-4265-94ce-175e1a12664a","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.24653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T01:44:26.117668Z","title":"Robomind 2.0: A multimodal, bimanual mobile manipulation dataset for generalizable embodied intelligence","venue":null,"work_id":"3be0dda9-d954-48d9-b094-2369a1f83699","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:15012ed7808d46e17a71fcb52abf853b554559904f5afe18b19ba88ca49aa54c","observation_id":"83c7ed4f-b846-40ef-a3fd-9f3c4c43b0bf","resolution":{"observed_at":"2026-07-01T23:36:22.794021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8592.2024","doi":"10.1109/iros58592.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dreher, T","venue":null,"work_id":"69074442-dd66-4e16-9324-8a2cc82601db","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:77df06535620bb4dde0183ab52a05f124c8ba4fd61b1786a43150c6eb11075fe","observation_id":"9f9e200e-6f2a-49b1-aa85-738a53e43478","resolution":{"observed_at":"2026-06-28T14:22:18.472939Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0139.2025","doi":"10.1080/00140139.2025.2514600","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"https://doi.org/10.1109/iros60139.2025.11247690","venue":"Ergonomics","work_id":"507e5638-ed4b-4d97-95a4-4d8037203959","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:030aab24d5cdc115347106572ce141b2ee87866c3cc8d86dc92bb1104c01535c","observation_id":"4d81a723-784b-450e-b437-16eb79486eb4","resolution":{"observed_at":"2026-06-28T14:22:18.488720Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:82b350514d08cefeb7bfc46f1b3e59361f8602f381b9e04fd5953030113f3d86","observation_id":"e43b37e4-8ccf-46ca-9633-b77188fbeabd","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"INTRA: Interaction relationship-aware weakly supervised affordance grounding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:d66cf714565e4c8e8bb859d0082d413b65d6b41783280dce8b779e03d0b76655","observation_id":"0f111694-71b5-40ab-b21f-26fea7d90d48","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15650","last_updated":"2026-07-10T15:14:57Z","snapshot_observed_at":"2026-08-16T12:51:30.217479Z","submitted_at":"2025-04-22T07:16:56Z","title":"AffordanceSAM: Segment Anything Once More in Affordance Grounding","version":3},"cited_work":{"arxiv_id":"2504.15650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15650","snapshot_observed_at":"2026-07-13T01:20:01.599725Z","title":"Affordancesam: Segment anything once more in affordance grounding.arXiv preprint arXiv:2504.15650","venue":null,"work_id":"d3f96a23-69ad-443b-b3fb-1df396d36590","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2504.15650","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:6539eb96b0e443994c8039106d9324c4158bf842a9d676793025398858c4395b","observation_id":"d2317434-da50-4484-be7d-677cf885582b","resolution":{"observed_at":"2026-07-13T01:20:01.599725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:4809e8ff35faa3fa169368f6a479b7cb22c91358493629853715cfc92f9e96b8","observation_id":"14fcc052-b9b5-41f8-8424-3638d0d6ccf8","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Robo- abc: Affordance generalization beyond categories via semantic correspondence for robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:1b3d616d8998ff1e5b76bf920ab2e5d5f693e74739fc02f51da22de98ed5163c","observation_id":"698dd70c-5f37-416e-97f5-667ab380ad9c","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":"2403.12945","doi":"10.48550/arxiv.2403.12945","metadata_source":"pith","pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","venue":"cs.RO","work_id":"13253de2-3d89-415c-8c2f-3adb25d4c337","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:a9013308b8c69bd21490db0316ba0524cf8f7bfa4381d9335c00434bef3701e1","observation_id":"b20230e8-1212-4afc-98e1-6eaae80e4f72","resolution":{"observed_at":"2026-07-01T23:36:22.828889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Shamma, Michael S","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:f317a58d177446100ee1cc62eb055f8f09066f8626c25a28a0c8c65d7093f70f","observation_id":"60d3fce1-f7b2-4102-b77c-ee077116fd34","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"RAM: Retrieval-based affordance transfer for generalizable zero- shot robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:521bab535dbe85bb1488ce10d0f85c4cbde0adbcc0a5dbe628eee16bfb3589a6","observation_id":"7585ac92-ddb9-4a0b-92e0-a6fa7513d185","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"LISA: Reasoning segmentation via large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:f1baf8408a923170dc37f26ca8e0313965601b0b02cdef9cabf422f0d2814ed8","observation_id":"35b063bb-d160-4e3c-ac40-7320c4f314d7","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Locate: Localize and transfer object parts for weakly supervised affordance grounding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:9e9bc87387ed443dbe3a1a5ad7ff506ef7f8b8cc6af98af61612a2126a1b93c8","observation_id":"cde317c0-4b3a-4982-95e2-ce952193be1e","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Learning precise affordances from egocentric videos for robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:65baf08944a389c3eb853e04815b1108b5ca66f2bd12d8d52658037d65d17051","observation_id":"de3aa980-aed5-4ee8-830d-5b4f57fd50da","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-981-96-0963-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Proceedings of the Asian Conference on Computer Vision (ACCV), pp","venue":"Lecture notes in computer science","work_id":"1c74ad95-f4b6-471d-b671-11b1d50d0068","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:08ab820573961f0c6d037c2d7e46ec493f7a025593b1397773b79c9d2d9cddaa","observation_id":"71197256-1c93-4ef3-b7a4-b18cbec1af63","resolution":{"observed_at":"2026-06-28T14:22:18.490422Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:189b7095edf8784d3500b4f9db59d633cb076cf58316b28c271d71460bb4380b","observation_id":"c879b5a2-9a08-47c4-b9ea-1512a6b51f85","resolution":{"observed_at":"2026-06-28T14:22:18.481547Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-08-15T23:16:19.228206Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":"2511.10647","doi":"10.48550/arxiv.2511.10647","metadata_source":"pith","pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","venue":"cs.CV","work_id":"0a54b500-1e9d-46c2-85eb-8e16cbac8461","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:62d142de59d9dae1fe09f8c158fe2a7453aacb363dfeecfbb819aacbdd6d4632","observation_id":"d5507821-5415-4ea0-abb3-e0c4e5d51b07","resolution":{"observed_at":"2026-07-01T23:36:22.807886Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Fast interactive object annotation with Curve-GCN","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:2cd3066bcb273414a14143ee8dab27680af3e8ec53a608ff1be1fa63dd75ff12","observation_id":"97c3a75c-1ab7-409b-8230-72376054f69a","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Joint hand motion and interaction hotspots prediction from egocentric videos","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:42c74d2c31be27307fddba806f81875216acb348d484b94987f3efccc7faa0dc","observation_id":"5ed72147-70d0-4324-905a-8f073c066079","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8592.2024","doi":"10.1109/iros58592.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dreher, T","venue":null,"work_id":"69074442-dd66-4e16-9324-8a2cc82601db","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:37ce9277e0b2df4831a6eebeb23c053120dc63620f8533290b2501fee7548dc5","observation_id":"bf58e3c5-f3bf-4a87-aef6-924fc7cd121c","resolution":{"observed_at":"2026-06-28T14:22:18.492671Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Geal: Generalizable 3d affordance learning with cross-modal consistency","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:2262117ab10034f74193b05ffa540b6edddd2324dbab5967295f64ed1674858e","observation_id":"4ef0dfac-1115-4c18-9783-9a3065b1a390","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Learning affordance grounding from exocentric images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:cdea42470d4ef406d85a6cde2888ec39973ed17058495a8dda9bbf18c61913b9","observation_id":"fd4277b8-c910-4da9-9612-6458b1721e61","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"GLOVER++: Unleashing the potential of affordance learning from human behaviors for robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:7614fbdc8187bb0ac9ed191d49577da3b0323b27805d5332cfddb2591f24f3e9","observation_id":"1caec5dd-d1a3-46ca-95a3-689d467b8ccf","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20608","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T23:36:22.817754Z","title":"Vagnet: Grounding 3d affordance from human-object interactions in videos, 2026","venue":null,"work_id":"5c059614-3af2-42a5-aefb-e9357ebb91d6","year":2026},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:4f530e7d71383b4e3ed5ef06ca432be8fad75f9acca65c8df1691116c9974ca2","observation_id":"3010b5d4-154b-491a-8f44-5bba5e95651f","resolution":{"observed_at":"2026-07-01T23:36:22.820296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"CALVIN: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks.IEEE Robotics and Automation Letters (RA-L), 7(3):7327–7334, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:1049487603e8fd2403b49648f57dfdadef96b66618ea400669c910d38e8cd77c","observation_id":"92d65551-31b3-4d85-be2e-cd8f808635f0","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"cited_work":{"arxiv_id":"2511.16719","doi":"10.48550/arxiv.2511.16719","metadata_source":"pith","pith_arxiv_id":"2511.16719","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3: Segment Anything with Concepts","venue":"cs.CV","work_id":"4a72a006-2592-4554-aad0-a9c41a9f952d","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2511.16719","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:3f20f1c02c45096d35aa486c8cc9d008d1623514bd63a9df39055b46e99c6a29","observation_id":"048b27ac-2891-4227-80c4-b3fd6c98e3a1","resolution":{"observed_at":"2026-07-01T23:36:22.824728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.21571","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:47:31.675799Z","title":"Scalable vision-language-action model pretraining for robotic manipulation with real-life human activity videos","venue":null,"work_id":"c8f06797-dd92-449e-9e82-4a684932eb12","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:d6c488c41d2b50ff35722e3b56c8b694a4565b4f81a72433f1c01306c2727c12","observation_id":"3312bc5c-0aee-49dc-8cc2-e97d484f45a9","resolution":{"observed_at":"2026-07-01T23:36:22.803837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Where2act: From pixels to actions for articulated 3d objects","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:4644422687eb7fbe7ee7bcc035c8e4e5fea92c9354329fca3876873c77a4d6e7","observation_id":"1d7be398-421d-44e7-96e6-b43676e6d6c1","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Teo, Cornelia Fermüller, and Yiannis Aloimonos","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:9d0f15b6411e40222fa1931b5ac03a0b99f6bc6a1a6d99b55b9b1e248650e105","observation_id":"2c3be21e-af25-4028-b1d9-a6fabf4e39de","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Object-based affordances detection with convolutional neural networks and dense conditional random fields","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:fc87a7f6890eec2134e101f14ba64e3668f5f52e762d006ad9b16ad09be5b717","observation_id":"900a96f3-6c93-427d-857d-4483028b4381","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Open-vocabulary affordance detection in 3D point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:c29474a6da776ffbd72fa36aeb105972ecd81ddc62486030f8e647d1cada81b2","observation_id":"c82a9a56-fb21-4e60-8107-7df41ca6aac7","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06256","last_updated":"2025-04-08T17:58:47Z","snapshot_observed_at":"2026-08-14T06:07:59.988146Z","submitted_at":"2025-04-08T17:58:47Z","title":"Transfer between Modalities with MetaQueries","version":1},"cited_work":{"arxiv_id":"2504.06256","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.06256","snapshot_observed_at":"2026-07-04T16:39:58.250680Z","title":"Transfer between Modalities with MetaQueries","venue":"cs.CV","work_id":"a89f31c1-6a3f-451e-9971-692c11219ea3","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2504.06256","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:2cfd2a904a4f9d739bfeb89e9c27a28ee72af0d6febad3c874e4399adf63bd24","observation_id":"69df2011-af0e-49ae-b425-9b43c00c53bd","resolution":{"observed_at":"2026-07-01T23:36:22.799196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3382.2024","doi":"10.1109/cvprw63382.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: 2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition Work- shops (CVPR W), pp","venue":null,"work_id":"aced34f9-871a-4ea9-8cac-1b541bdb3edd","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:5d02965c5bb0acbc324c40e799c6e15ed5af7f43b6e05b670d54fc3954976183","observation_id":"b6c6613c-7d80-4ac1-8753-fae39cfebc5c","resolution":{"observed_at":"2026-06-28T14:22:18.465381Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"ToolFlowNet: Robotic manipulation with tools via predicting tool flow from point clouds","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:6c666cdc9a735885484c9da7a54e9b805456244b345b75ac2991124fb15a7677","observation_id":"c94a7f06-da94-4082-a90a-e2b72a9aa2c2","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"GREAT: Geometry-intention collaborative inference for open-vocabulary 3D object affordance grounding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:8bb39837f16da640ca7d8b7da544ebda30a913ffd929e3dc4c1a6c5cfc7ba916","observation_id":"a02911ae-b33c-40a5-91ed-6521e94c37eb","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2453.2024","doi":"10.1109/3dv62453.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Artigrasp: Physically plausible synthesis of bi-manual dexterous grasping and articulation","venue":null,"work_id":"0a934419-001e-4f4e-833d-5c8c68d69b59","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:a74d0787c1eb9803ccbcf478fc0ec75f248d0cfd5a863b4f97e319fa433190b5","observation_id":"0af11e42-42cf-4807-93a1-8a96f631da30","resolution":{"observed_at":"2026-06-28T14:22:18.467832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.17895","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:41.200325Z","title":"Masked depth modeling for spatial perception","venue":null,"work_id":"6d4dd327-8cbb-4f65-9e5d-05dede7aa19f","year":2026},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:517eb0672a1d385002d927d44c979db70cf799b7d0b073eb259c2921cede58e7","observation_id":"80801a20-7ae6-4bff-b852-fda375e31351","resolution":{"observed_at":"2026-07-01T23:36:22.789518Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"UAD: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:fa35e5c436b180e69848656adba3d83307b24e9fbd288b9de09188e6208c4511","observation_id":"1eb87308-d814-443f-b4b8-b8cadf2f25b8","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Roboafford: A dataset and benchmark for enhancing object and spatial affordance learning in robot ma- nipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:952a00e572bcecdb627271609a1c08511bc7c57223e91a2064e3d63655bca7b1","observation_id":"d62cfb8e-7be6-4650-a11c-9a9912f24ca1","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0139.2025","doi":"10.1080/00140139.2025.2514600","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"https://doi.org/10.1109/iros60139.2025.11247690","venue":"Ergonomics","work_id":"507e5638-ed4b-4d97-95a4-4d8037203959","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:6ce75e047d20e29bc463411a6b4c1911e0685f676200ba0ed2749dd9aace06ff","observation_id":"118a1305-632e-4ee2-a499-a5ae89e2ba21","resolution":{"observed_at":"2026-06-28T14:22:18.470390Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Qwen3.5: Accelerating productivity with native multimodal agents, February","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:184099bbfc27462e3ff34b33ecced47b69964838ba2d58bb6a86d1f055d2fac6","observation_id":"8990a3a5-88f6-4717-b2cd-77fe2b176a9c","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:d4a99fe946889f1e0c57f5d3c372b9fbd23c2e64298b3edafb3f391494566cba","observation_id":"6aafcae2-65c4-4f4a-bb64-368aa81726db","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"O3afford: One-shot 3d object-to-object affordance grounding for generalizable robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:7e861478225e79f3f1f3e9378c09382a78010e797a30e23b86e0f472015db583","observation_id":"f8a25014-d56e-46d1-9c8e-d93d14b178c2","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"InstructPart: Task-oriented part segmentation with instruction reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:3404fd8c527cb4b2d67204dd5991b283af7e15cde3ec22ee695039ae24a8eff3","observation_id":"9d7af56f-26af-4583-91b6-afeb86f56f67","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Videoafford: Grounding 3d affordance from human-object-interaction videos via multimodal large language model,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:e2948528331021a0f1010c5738a9b239752ab78c44c9c327f596dca03a20631a","observation_id":"a11224da-484a-414a-af79-d007ac2ad1c0","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T03:46:32.418103Z","title":"Videoafford: Grounding 3d affordance from human-object-interaction videos via multimodal large language model.arXiv preprint arXiv:2602.09638","venue":null,"work_id":"23702bfa-f4ba-469e-9db5-b7d34edc2353","year":2026},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:08c05c0946cc94e40b77cb35d68fdf4ce6ee485f6cc32c396054c6d169eb293d","observation_id":"e3086738-1ad5-4e75-ab10-9ee35fa83066","resolution":{"observed_at":"2026-07-01T23:36:22.845970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Affordance-R1: Reinforcement learning for generalizable affordance reasoning in multimodal large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:c23f1aff72ff7b3e0c41dc7566e55fe74af7a93bddec5dddedc7d352cea83a6a","observation_id":"2f1a8842-1303-4c3b-a32b-46124a3fa884","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"AffordBot: 3D fine-grained embodied reasoning via multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:8f58bb37bc0ae7105c489fda91c0af7c66e786bb76c1f4ebd86aa573ddb93380","observation_id":"3b404c43-8f90-4b51-8867-e7255c9cd350","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"AffordDexGrasp: Open-set language-guided dexterous grasp with generalizable- instructive affordance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:36fb91daed482702fcd5db19258c2d9c7f6561fa2929fa85a7e5e45725978ae2","observation_id":"11f12107-89d7-4364-9e0f-41279f7801e6","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"RAGNet: Large-scale reasoning-based affordance segmentation benchmark towards general grasping","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:05217299848b8f734ad7055605a74763029bb6316ef16aaf34eb5c4a89d424d0","observation_id":"1fac1db1-1a33-48c4-b2b0-989988b35494","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13877","last_updated":"2025-05-27T01:46:53Z","snapshot_observed_at":"2026-08-15T09:21:12.808847Z","submitted_at":"2024-12-18T14:17:16Z","title":"RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation","version":3},"cited_work":{"arxiv_id":"2412.13877","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.13877","snapshot_observed_at":"2026-07-08T02:04:26.240460Z","title":"RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation","venue":"cs.RO","work_id":"86320616-05fa-4c08-8bc0-4377e53bdba5","year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2412.13877","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:9226252b038253a7c36b7d12dddb54bbcad9fe6dd617399747c8f3cc6e40eec0","observation_id":"517545ad-2d3b-4849-a79b-fc43e9662fc4","resolution":{"observed_at":"2026-07-01T23:36:22.816063Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"V AT-mart: Learning visual action trajectory proposals for manipulating 3d ARTiculated objects","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:bba37b3d1de9a9f0c309240a1be6a085e27958d1cd98a7e246c5deb6be2ac5bc","observation_id":"cc6dfeda-ed68-4b1b-b48b-e6dfa04b9eeb","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"AffordDP: Generalizable diffusion policy with transferable affordance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:0e6a032d0b515b1a91698be02d592ec56bd129615273cb5c93cf214cb44d28e0","observation_id":"5423649f-c035-4047-88e7-8b3ee0365713","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Sonata: Self-supervised learning of reliable point representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:fff73fde33abc4ac96a32bc0e76a6906e87252e114ddd3d29f035b061fb698a9","observation_id":"ef578bc8-e0f2-45c8-8c21-40e9b475adc7","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Weakly-supervised affordance grounding guided by part-level semantic priors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:3a9f4a72651defd31bf76d525ca64e39efc25c6ed3e2a01fecd8ce6da28df1c2","observation_id":"6b8ff5fc-0e9c-4e2f-87eb-b59d5c8f1eb4","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"A0: An affordance-aware hierarchical model for general robotic manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:8bb0f78dbc12f5d1ee38d089e5953952663e38297b5c98dda6c7a59924c0c978","observation_id":"542e2fe9-e8e2-4eb4-8788-2f1a40e4a90c","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Ground- ing 3d object affordance from 2d interactions in images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:4333d5cf92aa993838f4af2043f669712836e1ee086fdf6b061f574751c23a45","observation_id":"71474842-ff33-433d-afcf-eea34903129c","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"DFormerv2: Geometry self-attention for RGBD semantic segmentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:d05058cf90281c0b96344a47f55b1759ea30525e828159d5bc1b0cea50147b8c","observation_id":"1f2584b3-592c-486b-a639-4a29d283d196","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.21986","doi":"10.48550/arxiv.2509.21986","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yoshida, S","venue":"arXiv (Cornell University)","work_id":"4e7e220e-073b-4c30-ba17-8afe93a482d3","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:0d8c9f6e926f44e26b0f1aada74d50fad98d56f13527b777574df99626351e58","observation_id":"d0bc9dc8-e4d6-4131-b18a-633afe26781d","resolution":{"observed_at":"2026-06-28T14:22:18.460485Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1864.2025","doi":"10.1080/01691864.2025.2535676","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Text-driven affordance learning from egocentric vision.Adv","venue":"Advanced Robotics","work_id":"248ac6a0-59f9-4048-bc44-333943820e9e","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:239f6216e1107e9686279c953aab6b0e6ac306e94a0b46f51775de492130461f","observation_id":"fbc28354-bace-4bd9-bef0-e2dccb5d4114","resolution":{"observed_at":"2026-06-28T14:22:18.462979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Generating 6DoF object manipulation trajectories from action description in egocentric vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:d31008cb232e97d1cf56ee95b87a94dd10d0b6aa7818bf4d43b6618728f7f91b","observation_id":"6ea6d13a-e687-42ea-b371-5a773c581d1d","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"SeqAfford: Sequential 3D affordance reasoning via multimodal large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:a99835e42f224b9615a30e440a2dbd6de20716c68b0d596fbb6c6fad01d21fb8","observation_id":"0723ec1d-2b07-45fd-85b7-ed887080e07e","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5743.2025","doi":"10.1109/icra55743.2025","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: 2025 IEEE International Conference on Robotics and Automation (ICRA), pp","venue":null,"work_id":"69abf874-f559-4fcb-a658-fd7f3a6a2304","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:5173b8b7469981172eb9df216dcdb9b91ca44b62d778bac366ae26811c3544b9","observation_id":"3a92ccce-40be-4509-a916-55595c0928e2","resolution":{"observed_at":"2026-06-28T14:22:18.456202Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-12T00:49:15.263628+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T00:49:15.263628+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"General flow as foundation affordance for scalable robot learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:bd2d47a937f30a85c5f2a4af01246c10718975566aacd4b1ef00b292ec4014c7","observation_id":"6226e9fb-ac16-436e-a4aa-b6293ad66b52","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"RoboPoint: A vision-language model for spatial affordance prediction in robotics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:c3222040e5dfca6cdcf771d0630344f26c02557cc0ba0e0166afb9023127fdf3","observation_id":"59efab5a-732f-4a88-8e40-3af054875e5e","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:880ac35fbddb531287d514de23a84d2febfd6baf2a2aabb5573a5ccb6abd7f48","observation_id":"9de7e863-6ba0-4085-839b-23edeab5e173","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"FlowBot++: Learning generalized articulated objects manipulation via articulation projection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:00142be2337a4a6cd7ac0f4d7003c552562e9a2349427b3b8bde26172a89bfdf","observation_id":"21cab0bf-824c-45f7-99be-ac51bd7e5177","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.365185","doi":"10.1109/tase.2026.3651854","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Affordance-guided robotic grasping via multimodal large language model reasoning.IEEE Trans Autom","venue":"IEEE Transactions on Automation Science and Engineering","work_id":"efa19e96-bc83-4f2f-bcbb-ada17aa7519c","year":2026},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:62112e2ad79bf8f48359a12db85c4e93be41bfac149611f0b9d102e818cc2945","observation_id":"0ed549d5-1ebb-42d1-9e79-6fcec185634c","resolution":{"observed_at":"2026-06-28T14:22:18.495053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14987","last_updated":"2022-03-28T18:00:51Z","snapshot_observed_at":"2026-07-06T12:53:50.496350Z","submitted_at":"2022-03-28T18:00:51Z","title":"Multilingual Knowledge Graph Completion with Self-Supervised Adaptive Graph Alignment","version":1},"cited_work":{"arxiv_id":"2203.14987","doi":"10.48550/arxiv","metadata_source":"doi_reference","pith_arxiv_id":"2203.14987","snapshot_observed_at":"2026-07-09T21:46:34.506658Z","title":"Dickerson","venue":"cs.AI","work_id":"5c2060c6-427c-4321-be22-49ccae439d80","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"cited_paper":"/paper/2203.14987","citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:b454146b76921a6e691c68faaa8c6e4bf59d1e5ba6ee28f7f5661a0c977aa1bf","observation_id":"443ef74d-b1d0-4435-8120-7ab8a6fb8538","resolution":{"observed_at":"2026-06-28T14:22:18.458049Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2734.2025","doi":"10.1109/cvpr52734.2025","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Freeman, Frédo Durand, Eli Shechtman, and Xun Huang","venue":null,"work_id":"d0e5199d-8907-47b1-905a-07ab8b623a4c","year":2025},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:d41d940168d802ea5e60544e35732c45fcbeed9fabdcab7fcc1b073d248e2829","observation_id":"011e6fc3-d562-42b7-863d-14f281a90352","resolution":{"observed_at":"2026-06-28T14:22:18.453652Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:bfd15404ecd8517fe96884faf454bcd031e0240afe17b891348b67bce0d650f1","observation_id":"6b22beb0-3fae-48fd-bb30-2ccd60f49834","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:befdb9d0a2fddf7d273db73a012a3af69bb99a287f39fd547752ed5d4a642145","observation_id":"aed7fd1d-250f-4c01-a751-d22773f7126e","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"Use ‘obs_frame‘ to phrase it in visible terms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:0cfa7af90d33fca1e7010d31766b26ec21907ccb1d51c33802ccc956a09ec200","observation_id":"0b17b6a4-20a1-450a-a7bb-35dd61bfdc70","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"top-left","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:3735dc8cb4a58136bd122d50e36f048c408723a05cfde1ad221e4c4884aa08ed","observation_id":"bd62c4e0-e04e-40ed-badf-cc6f342812ae","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"21 If still ambiguous, choose the most likely minimal part and add one discriminative qualifier (e.g., color/position)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:7b0a039365d05cbd4490e46c8dcdf81a714440fc93627c3d997e372175dccfc6","observation_id":"26de986d-5749-4054-953d-6021014fb70b","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"it\", \"that","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:937dc5c3c2198d6c5586ad322db96d8a5c281cbc9aa11c61ce928ac3903e485a","observation_id":"2dc573b1-21e6-4fec-8826-2d9776b7b00e","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:13:13.043886Z","title":"robot\",","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-06-28T14:13:13.043886Z"},"links":{"citing_paper":"/paper/2606.02551"},"observation_digest":"sha256:2a56066a866d852700b7ab8a6e063fded447daa2a2f26ea4c80f020c184e46c0","observation_id":"023d3b32-f738-4ef1-8d7b-e13203a5cf8c","resolution":{"observed_at":"2026-06-28T14:13:13.043886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.02551","last_updated":"2026-06-01T17:50:16Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T05:27:27.264406Z","submitted_at":"2026-06-01T17:50:16Z","title":"AFUN: Towards an Affordance Foundation Model for Functionality Understanding"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":14,"parse_uncertain":0,"unresolved":66,"verified_exact":19,"verified_fuzzy":0},"total_outbound_references":106},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 106 outbound references and 0 inbound Pith citation observations for arXiv:2606.02551."}