{"as_of":"2026-08-06T21:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ea85bd307f609c8c9f812c26937deafab4297e26a6c585873d1febcca4e88cf","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T01:55:47.136350Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.11616/citation-record","integrity":"/paper/2605.11616/integrity","json":"/paper/2605.11616/citation-record.json","paper":"/paper/2605.11616"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Referit3d: Neural listeners for fine-grained 3D object identification in real-world scenes","venue":null,"work_id":"548f523d-86d0-4d93-bd8c-1ac30de60a4a","year":2020},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:4be1386623c151519c84bf357da28c785d1e085254aca3ba851d99031681fa29","observation_id":"71ac32d7-4e92-4b49-8e8c-33b60c45e84c","resolution":{"observed_at":"2026-05-13T14:02:51.612744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:296d79e95eaf06c313e9cc8be6275da5c9ea83dbc0de25a483b2520d60c763e3","observation_id":"43bba1dd-7904-483d-98ca-03249c41ce08","resolution":{"observed_at":"2026-05-13T01:57:05.024500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8b6aaa4f-d230-4fdf-b496-2dfaee6defba","year":2022},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:fcb6ac33c0d5ef4af7a5b46051043cc4435cfd60daae55050c2222a7ac977a06","observation_id":"30679490-8267-4466-b8a7-44868303cbe6","resolution":{"observed_at":"2026-05-13T14:02:51.667733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"cited_work":{"arxiv_id":"2511.16719","doi":"10.48550/arxiv.2511.16719","metadata_source":"pith","pith_arxiv_id":"2511.16719","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3: Segment Anything with Concepts","venue":"cs.CV","work_id":"4a72a006-2592-4554-aad0-a9c41a9f952d","year":2025},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"cited_paper":"/paper/2511.16719","citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:ce64122e02aecc516ba3688a0e649845cbdc66f77ffe30d6d0e761b23ce1a13c","observation_id":"b0b5e929-519e-4f25-8237-7d129684c488","resolution":{"observed_at":"2026-05-13T01:57:05.041722Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.687473+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ScanRefer: 3D object localization in RGB-D scans using natural language","venue":null,"work_id":"8e7883b8-3732-4a3f-a6aa-3d93f4495332","year":2020},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:98c15549a7d9ec089baa834153eddb39109dbe95dc262f871401fa1b0c02f272","observation_id":"4d85d5dd-9e29-4a3d-a5d2-b6f71dc094f8","resolution":{"observed_at":"2026-05-13T14:02:51.669722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Functional- ity understanding and segmentation in 3d scenes","venue":null,"work_id":"99a1c7f9-7f23-45fb-977f-27edb0d55f3d","year":2025},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:33952a29d14aa2c47e0d50fb0a3ef50e8c9d7ec4652014e5ebd03040473361b6","observation_id":"0c5f9b7b-8eeb-41d7-90a7-ae98c313ebc4","resolution":{"observed_at":"2026-05-13T14:02:51.658672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SceneFun3D: Fine-grained functionality and affordance understanding in 3D scenes","venue":null,"work_id":"d0c01a14-13f6-419f-8b16-26d39b2f5390","year":2024},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:b7522e8523661108e4bcbd2f9a7f8aaa5c040f72ea88873aa2a289b7ffdf8de2","observation_id":"91993a69-36e3-44c5-ac51-35aa2b8e3e6b","resolution":{"observed_at":"2026-05-13T14:02:51.656384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3D affordancenet: A benchmark for visual object affordance understanding","venue":null,"work_id":"b1bcd00b-3226-4ea4-b67c-2310bf1036b6","year":2021},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:e8e1a99e0f845e54e4477c30b0407bf13c89a8d1d952f6d8410780dacfc0700b","observation_id":"2233442e-4301-4e09-bd69-eee70028092f","resolution":{"observed_at":"2026-05-13T14:02:51.665810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning 2d invariant affordance knowledge for 3d affordance grounding","venue":null,"work_id":"34f7617f-0a81-46b0-af6e-ce76f917fe59","year":2025},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:6ac01a414d872bca3d44113c8a0a538f0ed412f4887eab6c68aeee4625872ac4","observation_id":"0758f5ec-3a7f-4ae3-8efd-8abd08926d09","resolution":{"observed_at":"2026-05-13T14:02:51.671656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task-aware 3d affordance segmentation via 2d guidance and geometric refinement","venue":null,"work_id":"fa31a848-f631-40eb-b4af-0ea077057ac5","year":2026},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:33e9930b76b75db25e114d77af05e4a0a3064a5e98fc63d175dac0d5ad565259","observation_id":"c2a60e94-c9e7-4603-9565-70fdf1dd19da","resolution":{"observed_at":"2026-05-13T14:02:51.673612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Segment3d: Learning fine-grained class-agnostic 3d segmentation without manual labels","venue":null,"work_id":"90dd1b99-85df-4b12-8ab2-003e5b3c73b3","year":2024},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:b9adf484c3a16974f893080eb9ee6684d603d0b129ae82d8a4b1f886a6583f65","observation_id":"64959bbc-5c0a-49c7-8999-802b7cb345d5","resolution":{"observed_at":"2026-05-13T14:02:51.651063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenIns3D: Snap and lookup for 3D open-vocabulary instance segmentation","venue":null,"work_id":"a902fb2a-1cb9-4f7a-a07c-60cc8d35195e","year":2024},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:866381f3b318dc9506a514ecd894a837395a8838138028427f4a2b5789867764","observation_id":"013b017a-74f3-4c7a-8ca0-fd8a252bca29","resolution":{"observed_at":"2026-05-13T14:02:51.642587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ConceptFusion: Open-set multimodal 3D mapping","venue":null,"work_id":"a3551c42-e71a-495e-b54b-e0fe352c13f3","year":2023},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:6dd81f61aef4c987ab7c6cd8f8e1c2f908ff27b68780fb70f47f8e230f1c3240","observation_id":"79b004ce-f568-4bfe-bbfc-82e5a9ffb4e8","resolution":{"observed_at":"2026-05-13T14:02:51.639395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LERF: Language embedded radiance fields","venue":null,"work_id":"2771229a-d6c7-4dc6-81fb-77853205a230","year":2023},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:9c90cc2e88468095130343fdb6b647d7033abfff35d42c1554812375cb1d717f","observation_id":"2686a365-f0d8-431b-a8de-c61d9b44afa9","resolution":{"observed_at":"2026-05-13T14:02:51.646944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Berg, Wan-Yen Lo, Piotr Dollár, and Ross Girshick","venue":null,"work_id":"32ad494c-7b07-4f86-b1d5-2368a57bd27a","year":2023},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:6157b02e827051253892937e5983ae653dbab2fd37aa28be91a1306ca7211aa9","observation_id":"5a496579-9d83-4021-8807-4a19bafb189d","resolution":{"observed_at":"2026-05-13T14:02:51.648984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where2Act: From pixels to actions for articulated 3D objects","venue":null,"work_id":"4dd51346-1d76-4c18-8226-237ccc40702b","year":2021},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:8de2f4ef0aab17e721b9e90d6c3405b585470666cfe6b9544871b55d4edd2f56","observation_id":"488a197a-eb2b-49cf-b881-c9112f97e06f","resolution":{"observed_at":"2026-05-13T14:02:51.653249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenScene: 3D scene understanding with open vocabularies","venue":null,"work_id":"c50a7116-7109-41eb-8fab-19a8fb1498b1","year":2023},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:4f9edfbdc448c80d51563dfce29c474d464f85f6c74e9057109f3763f6e1093e","observation_id":"70443655-d390-4d94-adfc-168b1ff210b5","resolution":{"observed_at":"2026-05-13T14:02:51.637329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":"2408.00714","doi":"10.1038/s41598-025-97590-3","metadata_source":"pith","pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 2: Segment Anything in Images and Videos","venue":"cs.CV","work_id":"acc13f66-d814-44f9-9688-375688bf2d4a","year":2024},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:693ad2c1a038594e5a30580007dbc86dfa7f517826c46388a56d2619ce039a10","observation_id":"dc68a5f7-7383-47b7-9d98-bbbf31cb1a9f","resolution":{"observed_at":"2026-05-13T01:57:05.035670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T04:24:23.885301+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Griffin, Matthias Nießner, Federico Tombari, and Francis Engelmann","venue":null,"work_id":"ae67d481-4f69-4df8-adf4-b60f3a5cfb89","year":2023},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:5300671568a062c76d5682ea43166bc48b3f3c54fb1787e82f6d6fe86575efc5","observation_id":"4963e30c-2f5e-4b1b-b54c-b9a0924506ed","resolution":{"observed_at":"2026-05-13T14:02:51.675861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SegGPT: Segmenting everything in context","venue":null,"work_id":"f36dec89-8142-4ce9-8e82-953d67326288","year":2023},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:e1699a759c5b02f2e1f6c8be2d592f505a0cd091d0b814fdab22cc9aa973b301","observation_id":"9c9513a4-2fbd-4247-adab-04d218143d3d","resolution":{"observed_at":"2026-05-13T14:02:51.677604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.10017","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affordbot: 3d fine-grained embodied reasoning via multimodal large language models","venue":null,"work_id":"9b9ca71b-ba16-4a15-9c32-fe098787aaac","year":2025},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:d2ce17c0185e715adf8cf2f2c94d3e2c8c80c1e66a00fdba917b4c1117be009d","observation_id":"42663b47-fb45-47eb-ab3f-6709161e5892","resolution":{"observed_at":"2026-05-13T01:57:05.030466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d-gres: Generalized 3d referring expression segmentation","venue":null,"work_id":"fad99cb0-a35a-4e45-b03e-0cdeaf021683","year":2024},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:bee98809bca5462bf526a5b87a08f4a1417a5429cc5865aa7fad74a25ea11bb7","observation_id":"2f078beb-8b34-4aa5-bed3-6e430cf00567","resolution":{"observed_at":"2026-05-13T14:02:51.681295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.06874","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:49:42.636755Z","title":"MVGGT: Multimodal visual geometry grounded transformer for multiview 3D referring expression segmentation","venue":null,"work_id":"8bced513-2eb4-49c6-9eca-dfd7d8e59bbc","year":2026},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:0bbdfaad3560c48ecab37a32008012f9df7b91b4fdfdc4dd4c6842f8f7a99935","observation_id":"03db3964-2480-4ab7-a19f-96fc92f3a3ca","resolution":{"observed_at":"2026-05-13T01:57:05.018368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"11 It must be explicitly mentioned; use \"None\" if unavailable","venue":null,"work_id":"8554def7-0936-42dc-a53f-8dd8a8bca668","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:e2bd5b9ae4e9890a5502719b5f74db77b171b3e32daa8002d26abc7ede2447c8","observation_id":"f3464c78-e69a-4a05-966e-7be46b951574","resolution":{"observed_at":"2026-05-13T14:02:51.630493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2b8aee13-22ee-4864-b0b0-347ab64bb543","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:fb7478acf05b5a2c5603d066ff07101f452cd2943bed65981e782b7c5701b006","observation_id":"f33b5f2d-0bff-4beb-a665-dc376ea4e3bc","resolution":{"observed_at":"2026-05-13T14:02:51.619728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8f93eac4-f4d2-4c28-ba3b-7c550f6f937c","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:1a79afae5baf357fdc61b7236fab6d8f1afb9e87631201e0250f3f7d70ff444a","observation_id":"9011e93a-1dea-4594-a815-a79b2ed01ab4","resolution":{"observed_at":"2026-05-13T14:02:51.625370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5271e993-ecf3-4662-9164-9a8179bf6333","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:d0726b0cfc38f87853369252a4f11dc9b9976efe9a3e3a3a1b36bf8c4fbd7169","observation_id":"51e7eb97-8ab7-453c-83f7-38237fc72b3b","resolution":{"observed_at":"2026-05-13T14:02:51.617799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"{instruction}","venue":null,"work_id":"28d4c5a4-b618-41a3-a7bb-0a7442d0eac1","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:68116520689b6f64077d98f686a5dde0363354999a130eabff209d501da7c606","observation_id":"d340a52b-b1f9-4e34-8011-8262a75e097d","resolution":{"observed_at":"2026-05-13T14:02:51.610870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"236a7f6b-15f6-45eb-b2e3-ac6d7c7f1e1d","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:388ae4144399fd5bbef06890f917491e79bb8df367081ef3551b582291b96082","observation_id":"eb2f76ac-f657-4cf9-91f1-7d845098fa25","resolution":{"observed_at":"2026-05-13T14:02:51.609105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"01eb4fe7-5b57-4e6d-832c-96008dfe8d82","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:4f736a2ab2c2f42a33d1b8fa0f01fb63c79bf7687ceb263be700b393686f2b08","observation_id":"1ac60a6d-85b3-4794-b17f-05da9cabdf11","resolution":{"observed_at":"2026-05-13T14:02:51.605038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"we were unable to find the license for the dataset we used","venue":null,"work_id":"20dab24a-f8fe-4e5b-9923-97a16996ad24","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:f448d2920810639343c83819e506ca26c834ec66bfa9a57ebad9e9093d22693b","observation_id":"f1e6ffd6-a29e-43e0-8522-a3e7fd524c2c","resolution":{"observed_at":"2026-05-13T14:02:51.679397Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guidelines: • The answer [N/A] means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"a7beb5a6-a83e-4946-8381-9e6a4e766aeb","year":null},"citing_paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:47.136350Z"},"links":{"citing_paper":"/paper/2605.11616"},"observation_digest":"sha256:747c826e862b685d0a476276957dc1774a9825d55933a1e655f56ac30356ce0c","observation_id":"e698f2b6-414f-46f0-84c9-cc102d7fa6be","resolution":{"observed_at":"2026-05-13T14:02:51.607340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.11616","last_updated":"2026-05-12T06:44:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T02:04:49.585721Z","submitted_at":"2026-05-12T06:44:47Z","title":"Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":5,"verified_fuzzy":20},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2605.11616."}