{"as_of":"2026-08-15T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f0cbf033adefb3efabc03e856808dda9c065e86f5f92740d2f15457c850ccd7","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:25:01.084829Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08929/citation-record","integrity":"/paper/2608.08929/integrity","json":"/paper/2608.08929/citation-record.json","paper":"/paper/2608.08929"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-14T04:24:59.589172Z","title":"GPT-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.589172Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:f333a1e79bcf3fc29ea44796cda3667cd8637c31698d91ef9b723c5144c272f4","observation_id":"0c90af25-5541-4c4f-9afe-fae9ca250baa","resolution":{"observed_at":"2026-08-14T04:24:59.589172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.607413Z","title":"Do as I can, not as I say: Grounding language in robotic affordances","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.607413Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:c33e08682f1f89223f2d9fc66bf7e2cf140a7ee12cfb45899b011e6faccf3f61","observation_id":"ffb8cbdb-de47-48cb-bbee-413cbb585b25","resolution":{"observed_at":"2026-08-14T04:24:59.607413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.629573Z","title":"Affordances from human videos as a versatile representation for robotics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.629573Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:dea038a17b07228d4a2eed02dc04171402adcd0ce1680d80611ba6f4dba2d457","observation_id":"fe0cd259-cc13-4ed5-8fed-b02154ff954f","resolution":{"observed_at":"2026-08-14T04:24:59.629573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.639580Z","title":"ViSPLA: Visual iterative self-prompting for language-guided 3d affordance learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.639580Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:8bfa47fb7a713b4f592e2b626e4f4594adb7e7ab01976b63104723da20241e59","observation_id":"23b284c5-00f8-4172-9801-242bb42dfc63","resolution":{"observed_at":"2026-08-14T04:24:59.639580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.660952Z","title":"Grounding everything: Emerging localization properties in vision-language transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.660952Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:ce331d0b5b01e7e6e349d71532358528e196b82f9ba7df8c798fb23f2c723e0b","observation_id":"68b794f9-1230-4b4f-9797-95df22f12e47","resolution":{"observed_at":"2026-08-14T04:24:59.660952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.671131Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.671131Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:8070c70f65c62acf0f105f88d9de1933fcb0feb7fba786e1e88f0e06d9624464","observation_id":"c1bb08ab-4158-4e1c-abac-ec6f5fd4c7de","resolution":{"observed_at":"2026-08-14T04:24:59.671131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.699226Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.699226Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:cb79a0d43c7b2fc1237d04ebcca788926b6e5984fb319e488b451415c219a890","observation_id":"8c3749ff-eaf4-40f9-8e1c-5248b0afde54","resolution":{"observed_at":"2026-08-14T04:24:59.699226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.714778Z","title":"Worldafford: Affordance grounding based on natural language instructions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.714778Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:fba6799402f3be0c0955a60c3d44d3671f3e8a41e56a9cc4dbd58bb458b33e1d","observation_id":"dbb14ec9-bdfe-4c3a-8abb-8caa484cf3fc","resolution":{"observed_at":"2026-08-14T04:24:59.714778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.724265Z","title":"Affordance grounding from demon- stration video to target image","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.724265Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:fe317bccd72e5eff809fe56d295f9110754261a06138ad46d620f23fd38a691c","observation_id":"4eb42807-225c-4755-b0f1-41c975017b7d","resolution":{"observed_at":"2026-08-14T04:24:59.724265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.736175Z","title":"Affordances of augmented reality in science learning: Suggestions for future research.JSET, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.736175Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:9785b6a81c975011377554b7568478390ae9513db329aacee0b0597e2d805b48","observation_id":"d8bee974-b17c-40ca-b81d-2074d0d2c8e2","resolution":{"observed_at":"2026-08-14T04:24:59.736175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:24:59.747416Z","title":"3D- AffordanceLLM: Harnessing large language models for open-vocabulary affordance detection in 3D worlds","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.747416Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:58b99a0ccad91944e813c69397cd9cff786248a1b2ec104e223df80517fbab3e","observation_id":"2edb4eed-fc01-4e9a-90cb-f03fcdb32235","resolution":{"observed_at":"2026-08-14T04:24:59.747416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.441293Z","title":"Learning to act properly: Predicting and explaining affordances from images","venue":null,"work_id":"2569b3c1-c135-4286-964f-b7948eaf82d6","year":2018},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.775944Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:f865ed8afbb6434fccb0cbaa0b84d53366acc4ad33f79e57b47b4e00a98dc1ec","observation_id":"9ce199a6-ebeb-46e4-b643-519009b7ee28","resolution":{"observed_at":"2026-08-14T04:25:04.455761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.413273Z","title":"A deep multi-level network for saliency prediction","venue":null,"work_id":"452461a4-3a40-4448-8ec7-225406fd9919","year":2016},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.795211Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:dde49307b51d17e92a31db8037f84ebc1fdee10c5e8fc75a73913d12e1e31af5","observation_id":"6d80767d-3bb2-45d7-bb63-412c03ab1850","resolution":{"observed_at":"2026-08-14T04:25:04.421877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08492","last_updated":"2023-04-17T17:59:49Z","snapshot_observed_at":"2026-08-14T06:40:51.499973Z","submitted_at":"2023-04-17T17:59:49Z","title":"STRAP: Structured Object Affordance Segmentation with Point Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08492","snapshot_observed_at":"2026-08-14T04:24:59.815513Z","title":"Strap: Structured object affordance segmentation with point supervision.arXiv preprint arXiv:2304.08492, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.815513Z"},"links":{"cited_paper":"/paper/2304.08492","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:0f90fe3e9cdaa657365c25226409539eca0c501b4b9c234e51794a10644d44ba","observation_id":"ed81b43f-696c-4537-868a-04b6607701d0","resolution":{"observed_at":"2026-08-14T04:24:59.815513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.384438Z","title":"What does CLIP know about peeling a banana? InCVPRW, 2024","venue":null,"work_id":"5e72a50d-6b75-43ab-9b21-9ff1ed619b8f","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.832115Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:49a834f2787d95351e104ae9b9127bdbf4a1f25aec4aa891f0be7b99dddbeaea","observation_id":"266f2f7b-6fe7-46e6-a206-4be252bbc467","resolution":{"observed_at":"2026-08-14T04:25:04.394149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.361345Z","title":"Decoupling zero-shot semantic segmentation","venue":null,"work_id":"7d91ec57-d757-4b42-8176-fa5ab618ed80","year":2022},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.840616Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:0381bee65a3c60bc7763e00ae5cb74f0bd417c61977ea21c1938b56fff0f1a40","observation_id":"4ecb9732-2eca-4f63-a2c3-04eaf8b5602f","resolution":{"observed_at":"2026-08-14T04:25:04.368992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.340079Z","title":"Affordancenet: An end-to-end deep learning approach for object affordance detection","venue":null,"work_id":"1d98ed3a-623a-49f1-a914-f29677761344","year":2018},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.851479Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:d8f224d8c8310c63e6a92105067c92bec7ac3ac7778df6703adb2ac3d5726f58","observation_id":"ecb468b9-9766-4b73-ae85-401b1069ec29","resolution":{"observed_at":"2026-08-14T04:25:04.346232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.312676Z","title":"Demo2vec: Reasoning object affordances from online videos","venue":null,"work_id":"2d803044-743f-4225-b5c2-1053ee4aee5c","year":2018},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.862340Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:dce09eb4ad74a80faec941597b8b5ffcff6129fedcb01dcea363f8f32449db9c","observation_id":"974ec29b-a2c0-4b7a-92cb-b0cefdc6eb0b","resolution":{"observed_at":"2026-08-14T04:25:04.319488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.284238Z","title":"Learning 2d invariant affordance knowledge for 3d affordance grounding","venue":null,"work_id":"3bab8f3e-a7a7-46cd-94b8-0f4a0290622e","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.885087Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:b620d42258c25b985771dc917696e01147d8907f0c2943eb9ed422cc4e20c1e0","observation_id":"fce38ab4-ba7f-492a-8419-0f7312117c9c","resolution":{"observed_at":"2026-08-14T04:25:04.291383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.261733Z","title":"RLAfford: End-to-end affordance learning for robotic manipulation","venue":null,"work_id":"1e9c4826-4049-4a3a-b225-5948642d6976","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.902763Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:62fb212f7362b2685d6e319877c37af1b4d5cfca79b787a9911dc973308a6bd6","observation_id":"8dee3e03-7c6a-4b7d-b9d5-5428ca1d3633","resolution":{"observed_at":"2026-08-14T04:25:04.269011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.238198Z","title":"Psychology press, 2014","venue":null,"work_id":"3a7bb830-6aff-46be-981c-0faab9ae4fa4","year":2014},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.929390Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:347b676011ea93fd4d480280cd631ffd7c103b7b3c4ff0d507b7a12d382d9bc0","observation_id":"5ecbf72f-697b-4a53-8730-7a0f6dd58da5","resolution":{"observed_at":"2026-08-14T04:25:04.244381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.219934Z","title":"One-shot transfer of affordance regions? AffCorrs! InCORL, 2023","venue":null,"work_id":"53fedb70-6a79-4f1b-a502-b275e034f06f","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:24:59.964753Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:279f471cae668a72f1017cdd37bc8ae8ad2137590773c887ae2c157120369727","observation_id":"9055706a-76f8-4c06-a3e7-190cdaa511f8","resolution":{"observed_at":"2026-08-14T04:25:04.225469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.199233Z","title":"Visual affordance and function understanding: A survey.ACM Comput","venue":null,"work_id":"0de16bbf-242e-4c58-acdb-872faea88ee0","year":2021},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.000622Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:1425d5d3d8d7a3cb3564b9bc1d8f1e9ec380ed081a48927c736f407326054f58","observation_id":"1338fa03-b532-4531-afb2-3883fe4f9fa2","resolution":{"observed_at":"2026-08-14T04:25:04.205296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.176152Z","title":"V oxPoser: Composable 3d value maps for robotic manipulation with language models","venue":null,"work_id":"fa80493e-b74e-41a5-b1cb-fc5da10729ad","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.037007Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:8ade179116dec99bce31eba088eb5f20e6dd8ebd5c2128b2d11ce5b4d412ec60","observation_id":"696cf7c6-7498-4d9e-96c0-7e7c6b8bf271","resolution":{"observed_at":"2026-08-14T04:25:04.181681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.154356Z","title":"Predicting gaze in egocentric video by learning task-dependent attention transition","venue":null,"work_id":"ce88387c-d478-445f-9151-e42387acb9c1","year":2018},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.056783Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:a2fc9623d3fa05a6a38580fc5cb84703065896586037684b97c7ba556df24e7a","observation_id":"8afe09d7-64f5-4769-9826-c4dd0ccaf300","resolution":{"observed_at":"2026-08-14T04:25:04.162315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.132716Z","title":"Resource-efficient affordance grounding with complementary depth and semantic prompts","venue":null,"work_id":"48c59421-bc47-4564-b773-fdf185296618","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.064742Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:12ff6699089ac62ae7a3089a01585de7da60d80e97b711c542acee309ae7b72c","observation_id":"d77cd2e8-baa3-44f6-bb7d-a6c4d9296112","resolution":{"observed_at":"2026-08-14T04:25:04.139856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.105644Z","title":"Intra: Interaction relationship-aware weakly supervised affordance grounding","venue":null,"work_id":"a0b1d4d1-9518-48c6-9c04-888fad65474f","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.080869Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:9c8b0d4244c240343e3b913e8c691124d6cb78d4e971536ef47639a4502d59a6","observation_id":"41113a67-6034-4ecc-a46c-cf2baf41062a","resolution":{"observed_at":"2026-08-14T04:25:04.111039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.075541Z","title":"One-shot affordance grounding of deformable objects in egocentric organizing scenes","venue":null,"work_id":"ecf8ee65-23e1-4f09-ba1f-c6dd058e607a","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.095455Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:7a77fcfb50873e5e4acb9b466f1dc8348baf8c78c162668a5f1a13fb22ac05ee","observation_id":"a8063a6b-c54a-4461-b66d-ae70e69e6010","resolution":{"observed_at":"2026-08-14T04:25:04.085140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15650","last_updated":"2026-07-10T15:14:57Z","snapshot_observed_at":"2026-08-11T12:51:23.403314Z","submitted_at":"2025-04-22T07:16:56Z","title":"AffordanceSAM: Segment Anything Once More in Affordance Grounding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15650","snapshot_observed_at":"2026-08-14T04:25:00.117551Z","title":"AffordanceSAM: Segment anything once more in affordance grounding.arXiv preprint arXiv:2504.15650, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.117551Z"},"links":{"cited_paper":"/paper/2504.15650","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:373ef6bf07173bacac1a31ee54d3beb8200673b1d9781048b321e3782da3b63f","observation_id":"069f8cf6-52a9-4ca3-a88d-b6fc1a73c009","resolution":{"observed_at":"2026-08-14T04:25:00.117551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.057211Z","title":"Robo-ABC: Affordance generalization beyond categories via semantic correspondence for robot manipulation","venue":null,"work_id":"81df25b3-0b11-4389-9d03-22652ce4349d","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.135592Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:3dbbe85c78908e26e56d05a5070a8a22b0cf9549cb72538726261dc88effd7d2","observation_id":"7c2d24dd-b6b9-44b2-994f-5eed7e51d2ab","resolution":{"observed_at":"2026-08-14T04:25:04.063034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.037884Z","title":"Learning human activities and object affordances from RGB-D videos.IJRR, 2013","venue":null,"work_id":"855d09ff-0e1c-430a-892e-8d855d82877a","year":2013},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.156419Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:5a43390a8c31cd384008b8d6ac3cb7af9a23ab7b575fc5724d21f5830155f403","observation_id":"a8fc2d26-ffa8-409c-a314-574d7f92b23b","resolution":{"observed_at":"2026-08-14T04:25:04.043412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01563","last_updated":"2016-10-05T18:47:28Z","snapshot_observed_at":"2026-08-14T21:36:33.947421Z","submitted_at":"2016-10-05T18:47:28Z","title":"DeepGaze II: Reading fixations from deep features trained on object recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01563","snapshot_observed_at":"2026-08-14T04:25:00.162142Z","title":"Deepgaze ii: Reading fixations from deep features trained on object recognition.arXiv preprint arXiv:1610.01563, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.162142Z"},"links":{"cited_paper":"/paper/1610.01563","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:50e44c61224d959b6b847b5ac9d952c3077c5ffd1c970d34e4af954d86217426","observation_id":"1f416183-2019-417f-8be2-bb2b91c46302","resolution":{"observed_at":"2026-08-14T04:25:00.162142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:04.010364Z","title":"ClearCLIP: Decomposing CLIP representations for dense vision-language inference","venue":null,"work_id":"43778105-6628-4bd2-9f68-d1be6e765609","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.174784Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:b2f368507237f88d61eed96f2b346fa8e22770db108a6e46d29521c3405841e0","observation_id":"fe4e2f45-a73d-4c39-9e79-7df70dfc710b","resolution":{"observed_at":"2026-08-14T04:25:04.018396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.980382Z","title":"ProxyCLIP: Proxy attention improves CLIP for open-vocabulary segmentation","venue":null,"work_id":"27bbfa84-25d0-4ecd-89c7-f237fb9d99a1","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.191892Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:f7b4647fd5e8b5a433dab14b106d0c46ed3e274421c26f27a36ae209d129c94f","observation_id":"ea1242d4-0579-4661-93f1-9a8437735c5f","resolution":{"observed_at":"2026-08-14T04:25:03.993343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.958347Z","title":"Locate: Localize and transfer object parts for weakly supervised affordance grounding","venue":null,"work_id":"8b9d5231-14d7-4c79-9646-61c08ede7e75","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.225273Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:a41ea469234ac44081eed710afaf1ef135c467dcf8caa69d63b39182a32e4965","observation_id":"88823012-5ebb-44ea-b452-064d7e7c13c1","resolution":{"observed_at":"2026-08-14T04:25:03.964683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.937973Z","title":"One-shot open affordance learning with foundation models","venue":null,"work_id":"a5bf1001-88af-46d6-a512-a648e27a51fd","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.233301Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:c552c48edb02e3a6093575de8f587bdac6ec61b9b1ff35e053bb097491fd1cbd","observation_id":"717cf55a-8fc6-4e78-97b0-c0357274bca9","resolution":{"observed_at":"2026-08-14T04:25:03.943445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.885837Z","title":"Learning precise affordances from egocentric videos for robotic manipulation","venue":null,"work_id":"d4805b8b-ecb9-4a11-8a58-27254ff42e7c","year":null},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.247461Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:0f668c26570a2a542ca8794bb7c598b9667cf2a7ea2024c73b066247ed7eeb06","observation_id":"7c668544-b42e-4d63-9e52-ec4530d04b41","resolution":{"observed_at":"2026-08-14T04:25:03.897907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03647","last_updated":"2022-04-07T17:59:38Z","snapshot_observed_at":"2026-08-15T20:49:46.773954Z","submitted_at":"2022-04-07T17:59:38Z","title":"Adapting CLIP For Phrase Localization Without Further Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03647","snapshot_observed_at":"2026-08-14T04:25:00.259046Z","title":"Adapting CLIP for phrase localization without further training.arXiv preprint arXiv:2204.03647, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.259046Z"},"links":{"cited_paper":"/paper/2204.03647","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:ca10e7f79bc5b900534964d77cc9bebd4122bc83175aa8caee769d0dd5eeed40","observation_id":"fb7d6d82-20ea-4c99-aee4-86feb5326e8f","resolution":{"observed_at":"2026-08-14T04:25:00.259046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.819954Z","title":"Laso: Language-guided affordance segmentation on 3d object","venue":null,"work_id":"048f5beb-a77f-4720-b1a1-19703b88596f","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.284900Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:01e63a5f730958502e9e6a8c01f8d4836658654ac05a1ab21d2e1097da88f81c","observation_id":"11a4de50-1644-45f4-a37c-90027f578fe3","resolution":{"observed_at":"2026-08-14T04:25:03.832024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.760593Z","title":"Intermediate connectors and geometric priors for language-guided affordance segmentation on unseen object categories","venue":null,"work_id":"32e537f8-c0b4-4b29-92ee-0dead07825fd","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.297221Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:eff1241881b68a0b6e26547033a9b706529f3fc5b5fde0c30a6a4d272f644ef0","observation_id":"4bad5a48-78e9-4c7a-b470-29d334b2bc85","resolution":{"observed_at":"2026-08-14T04:25:03.788525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.681590Z","title":"Grounding DINO: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"f9161509-0871-4dc7-96b2-3a3aacb33e85","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.324757Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:4cdfd2def13b6cd80c38b54ae4d5fa574e27f0a93f15441768da0b4a6ab0ca61","observation_id":"9901d814-d276-4c26-ad2b-30f811338d11","resolution":{"observed_at":"2026-08-14T04:25:03.705858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.646611Z","title":"GEAL: Generalizable 3d affordance learning with cross-modal consistency","venue":null,"work_id":"0adb79b5-de4e-494d-9542-bc2e0c06412f","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.364855Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:b852d8507b86574f231a5eed36e1baa0d0af7b8a9b3a3f75a92c9e42f4f0c94d","observation_id":"bf42f043-7aa5-4f92-b070-ea919fe9bf30","resolution":{"observed_at":"2026-08-14T04:25:03.652879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.561397Z","title":"Learning affordance grounding from exocentric images","venue":null,"work_id":"eb633ba8-9902-4ae0-bac6-3cbe776979bf","year":2022},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.386788Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:c58dd60f3d4fc2f8918c6b37e1e705194d08127d72ca76bc49d83a67d3ac8995","observation_id":"581e08ba-5788-4952-80d3-417faf767293","resolution":{"observed_at":"2026-08-14T04:25:03.590463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.525902Z","title":"Learning visual affordance grounding from demonstration videos.IEEE TNNLS, 2023","venue":null,"work_id":"946cf62a-aa1d-472b-9357-4b7f5413936e","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.394273Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:cfe0cde63dfc8200beb339facbb33fdc38db4da04be0130e223e9a0fa5f8e196","observation_id":"f1e673d4-e3a6-4457-9025-ee5f77f96698","resolution":{"observed_at":"2026-08-14T04:25:03.539167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.447277Z","title":"Grounding language with visual affordances over unstructured data","venue":null,"work_id":"bef008e3-95da-49db-a7e8-8c37d820027e","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.414751Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:603bb3504f613e70a0bd2078fe254c935b569ad712f9f30ef85e00526c568e1b","observation_id":"2c96f9b2-4427-4dab-816f-ab81e9a0a929","resolution":{"observed_at":"2026-08-14T04:25:03.458647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:00.446329Z","title":"LAN-grasp: Using large language models for semantic object grasping.arXiv preprint arXiv:2310.05239, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.446329Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:2e1922527b732413628fc0de000dfe07f54fe261a47ad2d26e422f655d6851a8","observation_id":"b2811bba-d493-429c-a951-b4621a4e411a","resolution":{"observed_at":"2026-08-14T04:25:00.446329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.411058Z","title":"Embodied large language models enable robots to complete complex tasks in unpredictable environments.Nature Machine Intelligence,","venue":null,"work_id":"ceba125f-04df-41e6-9213-bb2e76cfa36e","year":null},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.452964Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:5cfe9d230c3c430b25099d1e66867f685f842a719fdd4124f137f74a903fd449","observation_id":"55fd075d-04e4-4681-8e1d-72fd0f046240","resolution":{"observed_at":"2026-08-14T04:25:03.427235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.356414Z","title":"Selective contrastive learning for weakly supervised affordance grounding","venue":null,"work_id":"4b90d775-3d3e-4629-9c5d-6050ad55e8db","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.484750Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:d60ab56d8d44f473768fe7a38d606faee4e08738745b0d61252b98a0b7591034","observation_id":"7b49a9e5-a562-464a-b016-ff8b8eab7380","resolution":{"observed_at":"2026-08-14T04:25:03.381372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.326002Z","title":"Affordance detection of tool parts from geometric features","venue":null,"work_id":"5d3e0a2f-d455-4608-b470-e4ef1ef44358","year":2015},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.534761Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:cfd7a3a865e2b7b442323c46c62135b07f6069bb3dcd7a616d0efe89f97e60e8","observation_id":"1fda5415-2668-4c8c-82c8-cc1eb0514a8a","resolution":{"observed_at":"2026-08-14T04:25:03.338340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.275973Z","title":"Learning affordance landscapes for interaction exploration in 3d environments","venue":null,"work_id":"390fc68a-de5e-4502-ae27-aeb6c02af04d","year":2020},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.551280Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:66e6c31650b53f32cdb5856c98a01655d1125dde39b72e2d99832c28e8164e56","observation_id":"d7d621d1-3dfe-4c2a-a7d7-0f8d9d9d162a","resolution":{"observed_at":"2026-08-14T04:25:03.285818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.201833Z","title":"Grounded human-object interaction hotspots from video","venue":null,"work_id":"fbdf2093-7b96-4ec8-a250-ce98a8b3454e","year":2019},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.568240Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:4daf2401e9007078ba6a2316e168ac2d7cc68f9a002b0ea3e385a27bb669861f","observation_id":"b66f641f-5f02-4c85-84e5-217868f73f40","resolution":{"observed_at":"2026-08-14T04:25:03.251898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.143671Z","title":"Caldwell, and Nikos G","venue":null,"work_id":"bb6c7704-e953-480e-b50c-7b879dae4af3","year":2017},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.584599Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:672d59cc9e8fd41cf667829078ef687c5bf8c9d0e78471f326a172adf2d166c5","observation_id":"d5ceb384-9d79-4876-b5ab-59d7f659f765","resolution":{"observed_at":"2026-08-14T04:25:03.158122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.093267Z","title":"Open- vocabulary affordance detection in 3d point clouds","venue":null,"work_id":"17824cfa-82bc-4878-a443-b195f7a6f0bd","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.602537Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:4ddfde37befc4ba3f42b818d2f8cff01cd56b3417b55dc3b816b65048304466d","observation_id":"58a8a30f-3057-4048-825a-23e78d2b1b7c","resolution":{"observed_at":"2026-08-14T04:25:03.110999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.064660Z","title":"Introducing GPT-5.2","venue":null,"work_id":"1ea972d6-2fe1-4301-b4d8-f9c0d88b5bf8","year":2026},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.613407Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:a7009b3aa2f59157f9bc86f9e716bea102066a3a39415175a3a19e4285197cd8","observation_id":"894e5207-7a1d-4989-a586-b5d9dbfba7cd","resolution":{"observed_at":"2026-08-14T04:25:03.072306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:03.031236Z","title":"Dinov2: Learning robust visual features without supervision.TMLR, 2024","venue":null,"work_id":"093756eb-fa35-4844-b80f-379a3fb0ad08","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.624631Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:448cd6340846faf950de72abf7bef7bc7f99d51de5e0e02cf49f1396bad8ee28","observation_id":"0372b1e9-6604-4ad0-aca5-34072ec1097a","resolution":{"observed_at":"2026-08-14T04:25:03.044033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.01081","last_updated":"2018-07-01T18:52:31Z","snapshot_observed_at":"2026-08-14T21:22:34.270188Z","submitted_at":"2017-01-04T17:16:54Z","title":"SalGAN: Visual Saliency Prediction with Generative Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.01081","snapshot_observed_at":"2026-08-14T04:25:00.638291Z","title":"SalGAN: Visual saliency prediction with generative adversarial networks.arXiv preprint arXiv:1701.01081, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.638291Z"},"links":{"cited_paper":"/paper/1701.01081","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:1f50c21aa7c07040cfe7837472172a535859290d6936af153befe552caf59920","observation_id":"b8aef135-de32-4821-bdbb-e29dd231fe13","resolution":{"observed_at":"2026-08-14T04:25:00.638291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.975756Z","title":"AffordanceLLM: Grounding affordance from vision language models","venue":null,"work_id":"2ebd9ff3-23b8-4721-b007-ac78981efb77","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.647791Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:a6225a8fb90b87351326e5fa6fd7deeb8124f72a48ccfb911077e82666415e1e","observation_id":"fbeeb65e-8ca6-4bbb-bc35-f259f2255f31","resolution":{"observed_at":"2026-08-14T04:25:02.989761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.934903Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"ff9308a2-06f4-4f24-ac78-b9ccda3efe84","year":2021},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.658615Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:72f7f2df56a939ee10608e8d5b5b705d500d130a22932d8ac0c5b124c73e7813","observation_id":"b3abf650-1e3a-4a6f-a703-9141e30b5949","resolution":{"observed_at":"2026-08-14T04:25:02.942168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.864823Z","title":"Strategies to leverage foundational model knowledge in object affordance grounding","venue":null,"work_id":"660b2b30-ffd0-4c12-b42f-0156e61fcd58","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.673344Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:15cac5cffb67abadfba5d52755469dde21cd23b1f052d3350675077c0d8590d7","observation_id":"8216afe2-d635-4de2-a23e-9a6004cc7b97","resolution":{"observed_at":"2026-08-14T04:25:02.880344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.817179Z","title":"Language embedded radiance fields for zero-shot task-oriented grasping","venue":null,"work_id":"f3981bad-1084-479b-ae33-248455078069","year":null},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.692986Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:2314924cde079a41b1d41d0b2ab23fda3b7cfd763c3ca0ebdaaebd17772b5cb1","observation_id":"d238b413-a0d4-45ed-8222-bede1fb6057a","resolution":{"observed_at":"2026-08-14T04:25:02.838191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-14T04:25:00.724745Z","title":"SAM2: Segment anything in images and videos.arXiv preprint arXiv:2408.00714, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.724745Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:19b57c6fe9e7692fa5a56752a008505cb2b36ebc4f6723b7505b4197f90d8a0a","observation_id":"c6fb0534-4c8a-4309-a618-ee395027411f","resolution":{"observed_at":"2026-08-14T04:25:00.724745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-14T04:25:00.735823Z","title":"Grounded SAM: Assembling open-world models for diverse visual tasks.arXiv preprint arXiv:2401.14159, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.735823Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:3fead5282e722c9c06657669495d23f03dd6b226e74ca8209856edc13d0fe1a4","observation_id":"466fbedd-f008-48b2-bebb-0d918cc03175","resolution":{"observed_at":"2026-08-14T04:25:00.735823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.755952Z","title":"Adaptive binarization for weakly supervised affordance segmentation","venue":null,"work_id":"8f995890-317b-4d5e-ab80-79fa16e7b57a","year":2017},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.748854Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:9e8c39f60e4357e0fe0f44280dca8061084291e02a86a9a35a64793deccd1e1c","observation_id":"efb000cc-f37c-4718-897f-f379f14627dc","resolution":{"observed_at":"2026-08-14T04:25:02.775254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.697624Z","title":"Weakly supervised affordance detection","venue":null,"work_id":"7a104cca-1d9f-4ffd-be64-935b8622c390","year":2017},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.776547Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:cb8a43fabf78d41f3d60e630c2a7e255a25dbec1627b6d879072acf5ee98be62","observation_id":"ad19fbfd-b14c-41c3-9661-f1c41da11300","resolution":{"observed_at":"2026-08-14T04:25:02.709743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.663431Z","title":"GREAT: Geometry- intention collaborative inference for open-vocabulary 3d object affordance grounding","venue":null,"work_id":"a50e9c7a-537f-460f-8bb5-32010618c2b9","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.788035Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:8f108211f724f0f9942e2d5b6c25b6fc88bb4d3968b235a25477f88f92f1047c","observation_id":"76e1712d-49c6-4266-a588-5132fd5876d7","resolution":{"observed_at":"2026-08-14T04:25:02.671657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.613080Z","title":"Learning 6-DoF fine-grained grasp detection based on part affordance grounding.IEEE TASE, 2025","venue":null,"work_id":"de8ea7f9-6faa-4496-b5e8-458ed4d1b3c7","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.795341Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:5fc4e532ff1286b7a81821863d5915150cffc15a755f28808ecf3a101aea28da","observation_id":"a1413b01-06c7-434f-861e-c33a84e8879e","resolution":{"observed_at":"2026-08-14T04:25:02.635005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.559139Z","title":"Closed-loop transfer for weakly-supervised affordance grounding","venue":null,"work_id":"396dbff7-a914-4de1-a20a-7349cca87698","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.803824Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:b6192b6225f6d4de5d06a2979fe6b5725d2e2fe152733dfa3b2c25480f1f5669","observation_id":"cfcf9a7b-96a8-439d-b112-278c5315f6e6","resolution":{"observed_at":"2026-08-14T04:25:02.569620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.515505Z","title":"Oval-prompt: Open-vocabulary affordance localization for robot manipulation through llm affordance-grounding","venue":null,"work_id":"e926683d-195e-4311-a358-26ce19d053dd","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.816303Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:32d5af0679c5de970a86f5a67ec2fa3c84776b824000a7b2cae551049f0e437b","observation_id":"9a6c3ebd-c770-4d16-8fd8-94b765482766","resolution":{"observed_at":"2026-08-14T04:25:02.534748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.476406Z","title":"Open- vocabulary affordance detection using knowledge distillation and text-point correlation","venue":null,"work_id":"98ab9c73-9979-42b2-b349-2c055749d22c","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.829393Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:5fd50299af7783881df8846f4c05a0bbdb64575b21c2482caa48a157f28660fb","observation_id":"bc248883-96b6-426d-b370-e525a78a90a4","resolution":{"observed_at":"2026-08-14T04:25:02.484155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:00.839548Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.839548Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:97183921782a6c10ba966b40f1e4e298f24863b185ac27863fc34c6b439084b7","observation_id":"22bb1560-6d74-4eaf-a88e-74b28cbf8fce","resolution":{"observed_at":"2026-08-14T04:25:00.839548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.444372Z","title":"Predicting actions from static scenes","venue":null,"work_id":"7fd23c0d-ca06-4ca9-8648-09a74e050d1c","year":2014},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.845760Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:6792326b0c10a3f259244e791cfa960cd9b611b17b042cc0e499b805b0d86872","observation_id":"bb84c558-8e93-468b-96e5-a2ffb8a9ec67","resolution":{"observed_at":"2026-08-14T04:25:02.450212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.423286Z","title":"SCLIP: Rethinking self-attention for dense vision-language inference","venue":null,"work_id":"c6387115-e511-4626-a5a2-bc93df3f2100","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.851533Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:3f4c391a4b2081a63fa66237679666ca79f0260b3c452cff5fcb0decae39b1c8","observation_id":"cf155cb5-7662-440b-a49e-c9656041579e","resolution":{"observed_at":"2026-08-14T04:25:02.431152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.384924Z","title":"AffordDexGrasp: Open-set language-guided dexterous grasp with generalizable-instructive affordance","venue":null,"work_id":"25fb9870-8f5b-49e7-ac1b-ddfd33cc0208","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.857273Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:771f6973499cc2de0c27c82e9aaf8bdd0dbe727bb982f2090adbd3c1193eef0f","observation_id":"20b0ec59-60b8-4539-9009-a7083908b3fc","resolution":{"observed_at":"2026-08-14T04:25:02.397587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.363455Z","title":"3DAffordSplat: Efficient affordance reasoning with 3d gaussians","venue":null,"work_id":"2d9b70b3-2eb0-4e76-b5a5-b088a7212e77","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.866144Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:7cdea736605823d97eacfd805f09211a683abee1ae8737aab1a140cfa5c573c0","observation_id":"7136222f-54d2-478b-8a8b-14dad5f4ebfd","resolution":{"observed_at":"2026-08-14T04:25:02.368835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.343640Z","title":"RAGNet: Large-scale reasoning-based affordance segmentation benchmark towards general grasping","venue":null,"work_id":"cc08b67d-69a3-45f8-ba01-d2d8fd1890d9","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.873432Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:9fcfd5a090675e180c394030531809ef77aa0e1e10723bc7b7b714fffdf67bdc","observation_id":"47b4a63c-193a-4925-ae9e-192c5160731c","resolution":{"observed_at":"2026-08-14T04:25:02.349843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.316027Z","title":"Towards open vocabulary learning: A survey.IEEE TPAMI, 2024","venue":null,"work_id":"f3019adf-008a-45f7-b4c9-c0a3d110c441","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.878695Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:f861adb10e426de9301e4cf26b84cf6885d1f04f9d5a7bc68a0e986052edc7a1","observation_id":"8ded06cf-29b4-47af-94c5-af6ff16f42d4","resolution":{"observed_at":"2026-08-14T04:25:02.327991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.270870Z","title":"Florence-2: Advancing a unified representation for a variety of vision tasks","venue":null,"work_id":"c5ff156d-fad5-4e21-8364-21a247fe78c8","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.906075Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:602caa805947436d39ae3908d0a7ca1f3f9a0954011c2f4b3f83f85364d75688","observation_id":"0d78e3f5-6bba-4e70-ba61-da8dc89712cd","resolution":{"observed_at":"2026-08-14T04:25:02.295909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.229727Z","title":"SED: A simple encoder-decoder for open-vocabulary semantic segmentation","venue":null,"work_id":"38567155-4b70-4bf4-b2ed-3b97c55d06f2","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.913685Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:76ca41c5b18e20e6ec23533a081c56ea34eccb6f000c60f761d682537858175f","observation_id":"63b16190-3e95-4fbf-9766-b36ed82a104f","resolution":{"observed_at":"2026-08-14T04:25:02.254103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.179450Z","title":"Weakly supervised multimodal affordance grounding for egocentric images","venue":null,"work_id":"f5328ef4-4c34-4a54-9ba3-e1f2633c6133","year":2024},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.932308Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:fa5389685c6a2e044c2d5e030c2d68c1e8cb3c6b6fe045c3abccc340b30986fd","observation_id":"0daa9bcb-86db-45a3-88b5-7ab313fb2462","resolution":{"observed_at":"2026-08-14T04:25:02.189132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.153567Z","title":"Side adapter network for open- vocabulary semantic segmentation","venue":null,"work_id":"800ade3e-046f-4de5-8543-120bafbc86b9","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.937785Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:97d6aebd2365261319843e2b1095b9e9ca11b93bf4e0c7e9f06d67275f4983fe","observation_id":"a1ec0b89-792a-4008-b47f-91162fe68e30","resolution":{"observed_at":"2026-08-14T04:25:02.159291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.120226Z","title":"Weakly-supervised affordance grounding guided by part-level semantic priors","venue":null,"work_id":"94123229-2c6f-437e-905b-a80bfe4f2170","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.948684Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:c49eda1020d2b2d3571b1827754b60dcf31a8407a279cca1ec54d837df6ce642","observation_id":"27cbced3-9dce-4459-8fbb-2e036679ab1e","resolution":{"observed_at":"2026-08-14T04:25:02.138652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.058060Z","title":"Universal instance perception as object discovery and retrieval","venue":null,"work_id":"3a6c4759-f40a-4bc1-b785-28a2157a7162","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.976682Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:110c8c1ac32f7dd298dc8ae05949e14eb89acd06ebce58dffc0b525d2981ca7d","observation_id":"82fa5d50-2dfc-4f34-bf10-719899c24b54","resolution":{"observed_at":"2026-08-14T04:25:02.066019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.035685Z","title":"Grounding 3d object affordance from 2d interactions in images","venue":null,"work_id":"67ab5153-4834-4d87-b19d-fb782c8d2ac7","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:00.994192Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:390220a04f82d37ee5a1e17180528f7e90c4c0d9a2365e5eb30b41e0e44ef360","observation_id":"9afb80b5-1bbd-48d9-8eab-92922c4008d1","resolution":{"observed_at":"2026-08-14T04:25:02.042436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:02.010139Z","title":"2HandedAf- forder: Learning precise actionable bimanual affordances from human videos","venue":null,"work_id":"c2029b3e-cfc7-4559-9630-58a2a9fcc8a1","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:01.008038Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:857830f3695252dae292a8f91d1a20bb78f2f2141ab8b41b439dc786268b7126","observation_id":"e3e6d444-088e-479b-a857-563374124ff0","resolution":{"observed_at":"2026-08-14T04:25:02.019717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:01.976967Z","title":"SeqAfford: Sequential 3d affordance reasoning via multimodal large language model","venue":null,"work_id":"36a35d72-4046-4b4c-a6ef-8283c156d98e","year":2025},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:01.028686Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:1ed4cf1723e5efb3a7e92b07b4c6b241e8df2f4daad5ccfa89e31d80de38189b","observation_id":"fc099bc0-0d00-4d4c-8125-fc09cda77009","resolution":{"observed_at":"2026-08-14T04:25:01.989262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:01.951052Z","title":"One-shot object affordance detection in the wild.IJCV, 2022","venue":null,"work_id":"171505d6-977c-416d-976a-a41f7e7368ff","year":2022},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:01.034961Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:886e3f31eb7fb15f231f715bf658c4f1702e582508ef9ff3a6f94693a204616a","observation_id":"47122d56-c38e-4198-99ca-dc93fafc72f0","resolution":{"observed_at":"2026-08-14T04:25:01.957879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:01.900200Z","title":"Extract free dense labels from CLIP","venue":null,"work_id":"6845e8dd-bb48-47ab-8776-adf2848bef28","year":2022},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:01.043451Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:0c7503ff686e713b36674580661b59ef762dcd390bf6fa15e6662dbdc7da189e","observation_id":"06616474-0615-4f3c-be51-94f5a12d8657","resolution":{"observed_at":"2026-08-14T04:25:01.921563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:01.843836Z","title":"ZegClip: Towards adapting CLIP for zero-shot semantic segmentation","venue":null,"work_id":"b880f87e-c08a-4688-8f77-aea51a459f80","year":2023},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:01.057814Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:a5e39f0b61f1f26f19374339b4701139c805beca9841fdf51c77b556614260bd","observation_id":"3a2af93c-1d6e-4796-9a49-257bbb3cf77f","resolution":{"observed_at":"2026-08-14T04:25:01.855261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:01.783608Z","title":"Grounding 3d object affordance with language instructions, visual observations and interactions","venue":null,"work_id":"d407899c-4844-415f-873f-c767c05d682f","year":null},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:01.067228Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:e3e3a3f328c8e0debec6cbc39dd96ce3fbcadf33925e846fd7c759e83bb91537","observation_id":"442314b8-6c99-41ad-a706-3b0d1334788c","resolution":{"observed_at":"2026-08-14T04:25:01.806178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4461.34432","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:25:01.346056Z","title":"Seen” and “Unseen","venue":null,"work_id":"64721a37-9c03-4ebe-99c0-24c9da043827","year":null},"citing_paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:01.084829Z"},"links":{"citing_paper":"/paper/2608.08929"},"observation_digest":"sha256:324c215e782e590258b3d2e17ae6e331369b6ab55fbc05e9287d69f32673ba50","observation_id":"a7397722-d4ad-47d4-86dc-0a4b6b25fb7d","resolution":{"observed_at":"2026-08-14T04:25:01.372600Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08929","last_updated":"2026-08-09T21:44:34Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T04:17:50.815688Z","submitted_at":"2026-08-09T21:44:34Z","title":"Zero-shot 2D Grounding with Novel Affordance Types"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":1,"verified_fuzzy":69},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 0 inbound Pith citation observations for arXiv:2608.08929."}