{"as_of":"2026-08-09T10:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:692a41b6c06a02e52bca96fd1baedd233b654b3989ae0770b4ff626273f38fb9","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T12:14:14.485021Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23797/citation-record","integrity":"/paper/2607.23797/integrity","json":"/paper/2607.23797/citation-record.json","paper":"/paper/2607.23797"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.16173","snapshot_observed_at":"2026-07-30T12:14:14.366207Z","title":"Vision-Language-Motion Maps: An open- vocabulary, uncertainty-aware, queryable motion attribute for 3D scene maps,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.366207Z"},"links":{"cited_paper":"/paper/2607.16173","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:d2f1305296378e12a8c2b5ff4e9d85b467314346e274ef04622e0136aab0add8","observation_id":"b7c95084-d7f2-4d89-9796-8a04a58e61f2","resolution":{"observed_at":"2026-07-30T12:14:14.366207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05714","last_updated":"2023-03-08T10:30:41Z","snapshot_observed_at":"2026-07-06T14:03:49.583141Z","submitted_at":"2022-10-11T18:13:20Z","title":"Visual Language Maps for Robot Navigation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05714","snapshot_observed_at":"2026-07-30T12:14:14.373723Z","title":"Visual language maps for robot navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.373723Z"},"links":{"cited_paper":"/paper/2210.05714","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:bb0d83c620af06e54f7323bca76aea85820901abdb129ace20758e12d8562228","observation_id":"7cd879ac-b2f6-4413-b5f8-8c5eb90e3368","resolution":{"observed_at":"2026-07-30T12:14:14.373723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07241","last_updated":"2023-10-23T14:56:15Z","snapshot_observed_at":"2026-07-06T14:51:48.920020Z","submitted_at":"2023-02-14T18:40:26Z","title":"ConceptFusion: Open-set Multimodal 3D Mapping","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07241","snapshot_observed_at":"2026-07-30T12:14:14.378827Z","title":"Conceptfusion: Open-set multimodal 3d mapping,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.378827Z"},"links":{"cited_paper":"/paper/2302.07241","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:528816bbdcb37aa21f31a035815fd1e7cd6156793189544a4a87e5b547194e78","observation_id":"371ca1c1-4a94-4be3-8399-176bad1533cc","resolution":{"observed_at":"2026-07-30T12:14:14.378827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16650","last_updated":"2023-09-28T17:53:38Z","snapshot_observed_at":"2026-08-09T02:12:31.765619Z","submitted_at":"2023-09-28T17:53:38Z","title":"ConceptGraphs: Open-Vocabulary 3D Scene Graphs for Perception and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16650","snapshot_observed_at":"2026-07-30T12:14:14.383854Z","title":"Conceptgraphs: Open-vocabulary 3d scene graphs for perception and planning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.383854Z"},"links":{"cited_paper":"/paper/2309.16650","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:e5b8984610a3284dc95033773aea8d4f9fd48e975108c766aead8d392e7ff640","observation_id":"df3165c0-46bb-46ed-bc74-b60702317462","resolution":{"observed_at":"2026-07-30T12:14:14.383854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17846","last_updated":"2024-06-03T17:12:25Z","snapshot_observed_at":"2026-08-03T07:21:49.675852Z","submitted_at":"2024-03-26T16:36:43Z","title":"Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17846","snapshot_observed_at":"2026-07-30T12:14:14.390962Z","title":"Hierarchical open-vocabulary 3d scene graphs for language-grounded robot navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.390962Z"},"links":{"cited_paper":"/paper/2403.17846","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:ed3351d4aaf98e31e20093a0f0425837373cf0be42aa215ab85458863b071702","observation_id":"722ac370-7355-4785-b309-005d9eab15b5","resolution":{"observed_at":"2026-07-30T12:14:14.390962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13817","last_updated":"2024-05-20T13:11:48Z","snapshot_observed_at":"2026-07-06T17:33:25.448648Z","submitted_at":"2024-02-21T13:55:53Z","title":"Khronos: A Unified Approach for Spatio-Temporal Metric-Semantic SLAM in Dynamic Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13817","snapshot_observed_at":"2026-07-30T12:14:14.397824Z","title":"Khronos: A unified approach for spatio-temporal metric-semantic slam in dynamic environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.397824Z"},"links":{"cited_paper":"/paper/2402.13817","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:f27bf2ab3babb6c7b8c3b3faae3aa802894884e8e0291df6f940688479bb2249","observation_id":"e98cac07-0bd6-4eca-9337-efb4cf1ac461","resolution":{"observed_at":"2026-07-30T12:14:14.397824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08355","last_updated":"2017-06-26T13:16:57Z","snapshot_observed_at":"2026-07-06T05:48:25.520994Z","submitted_at":"2017-06-26T13:16:57Z","title":"Deep Semantic Classification for 3D LiDAR Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08355","snapshot_observed_at":"2026-07-30T12:14:14.405210Z","title":"Deep semantic classi- fication for 3d lidar data,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.405210Z"},"links":{"cited_paper":"/paper/1706.08355","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:1a320b9d2615fee54917f0cfe607f3f95ace96036cb2baf5c081fe2302d57fe2","observation_id":"9a831e56-ad4d-4a1c-b5c5-6a743934ea63","resolution":{"observed_at":"2026-07-30T12:14:14.405210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.410124Z","title":"The office marathon: Robust navigation in an indoor office environ- ment,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.410124Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:e6da54814e687e73b710e1a4ee73e2ae41ccc2429142c94d8c91766f3dbf414d","observation_id":"f92093e3-908c-427e-8211-6c35e92b55f9","resolution":{"observed_at":"2026-07-30T12:14:14.410124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04999","last_updated":"2025-05-29T13:57:04Z","snapshot_observed_at":"2026-07-06T19:46:54.707852Z","submitted_at":"2024-11-07T18:59:27Z","title":"DynaMem: Online Dynamic Spatio-Semantic Memory for Open World Mobile Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04999","snapshot_observed_at":"2026-07-30T12:14:14.414201Z","title":"Dynamem: Online dynamic spatio-semantic memory for open world mobile manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.414201Z"},"links":{"cited_paper":"/paper/2411.04999","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:7bf5679ac7495f3c34c7275e22e69b19c6d5434dd938a73e112f650f0685777b","observation_id":"c8d0b2cf-b964-4c5e-a0c0-91af794cdb09","resolution":{"observed_at":"2026-07-30T12:14:14.414201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11989","last_updated":"2025-03-19T03:24:54Z","snapshot_observed_at":"2026-08-05T21:54:24.161621Z","submitted_at":"2024-10-15T18:52:22Z","title":"Dynamic Open-Vocabulary 3D Scene Graphs for Long-term Language-Guided Mobile Manipulation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11989","snapshot_observed_at":"2026-07-30T12:14:14.418959Z","title":"Dynamic open-vocabulary 3d scene graphs for long-term language- guided mobile manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.418959Z"},"links":{"cited_paper":"/paper/2410.11989","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:f90cf968f9253e2118e2cca63d6bd087256eb4e09ab1cbe953a76eca025d54e6","observation_id":"d2d470e3-4901-42ac-a323-5e07b920edb8","resolution":{"observed_at":"2026-07-30T12:14:14.418959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.424180Z","title":"Dualmap: Online open- vocabulary semantic mapping for natural language navigation in dynamic changing scenes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.424180Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:05a04e034c1568bf5d41a95dcbb91bb5909e30d8990278710a2d122e4f65c99d","observation_id":"0ea08096-befa-499e-ba31-e07c40f00108","resolution":{"observed_at":"2026-07-30T12:14:14.424180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17537","last_updated":"2023-06-12T17:25:06Z","snapshot_observed_at":"2026-08-08T15:40:41.323570Z","submitted_at":"2023-05-27T17:39:38Z","title":"Modeling Dynamic Environments with Scene Graph Memory","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17537","snapshot_observed_at":"2026-07-30T12:14:14.429351Z","title":"Model- ing dynamic environments with scene graph memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.429351Z"},"links":{"cited_paper":"/paper/2305.17537","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:cdcd37bcded3f44bf584936c43f48349d36dce26ac372257d14862d7589ba61b","observation_id":"b4015a3c-7e41-4565-ba54-9079e0d6bdb6","resolution":{"observed_at":"2026-07-30T12:14:14.429351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.434089Z","title":"Active perception,","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.434089Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:89be9bc14dc2f235336ad565e688e1effa4082f5280e36b7811147464caa130f","observation_id":"497c77bd-f702-4780-8965-de603bdb9144","resolution":{"observed_at":"2026-07-30T12:14:14.434089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.438495Z","title":"Revisiting active per- ception,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.438495Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:0771bbec8685d77090b7c0e6982b71a4f3e46353b1d072d96f214ab96dd27eb3","observation_id":"370248ab-5964-40b6-88f6-f149ff9785a3","resolution":{"observed_at":"2026-07-30T12:14:14.438495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.443205Z","title":"The determination of next best views,","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.443205Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:81b1cae50b97d5d65b38feae823ca9f1b56d3d3c62fbe9dacc658f9eb2739cc5","observation_id":"fd695e25-7d9b-4562-b43f-d953b4ebfdb6","resolution":{"observed_at":"2026-07-30T12:14:14.443205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.447675Z","title":"Receding horizon “next-best-view","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.447675Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:f549e6b3de9bdcef5424465552d25d9681f2fdb8c8d276bff707512269bcff5c","observation_id":"defff140-8378-4651-96b6-f95f2d448adc","resolution":{"observed_at":"2026-07-30T12:14:14.447675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.452623Z","title":"Persistent robotic tasks: Mon- itoring and sweeping in changing environments,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.452623Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:7a533b57e64162856d8b1434353713df49b3cc51b84f92a8a0cf1b6232158505","observation_id":"d0290a07-278b-4cf3-be05-4ac23d255eca","resolution":{"observed_at":"2026-07-30T12:14:14.452623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.456824Z","title":"Persistent monitoring in discrete environments: Minimizing the maximum weighted latency be- tween observations,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.456824Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:96eff99d3625edd359c2414c6fc5f94c77cb38f23da4b9dc21db95d14254dc07","observation_id":"d0ad227c-f705-4c09-8fa7-4bd0c2bfb990","resolution":{"observed_at":"2026-07-30T12:14:14.456824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.460350Z","title":"Effective page refresh policies for web crawlers,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.460350Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:4273bc36f6e7a9413f51e1ef796fb9861ff85c95d4786a583a85992a6a19b14d","observation_id":"ad742dd7-a159-4f71-b438-65d4310719d7","resolution":{"observed_at":"2026-07-30T12:14:14.460350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.463907Z","title":"Restless bandits: Activity allocation in a changing world,","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.463907Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:c4d342b77fba72576f9dae4abb77cc3d139d05d40d139c00ea574a496191194f","observation_id":"97142080-b5d9-4eee-9fc0-a49852dea44f","resolution":{"observed_at":"2026-07-30T12:14:14.463907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.467676Z","title":"Scheduling policies for minimizing age of information in broadcast wireless networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.467676Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:8b777b93904177adaabb8c9b330703562c9beb688f292d8de3761e0ba4ec4194","observation_id":"2bbac8d4-11fa-4511-a8f5-4dcbdf4f8ca2","resolution":{"observed_at":"2026-07-30T12:14:14.467676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:14:14.472170Z","title":"Age of information: An introduction and survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.472170Z"},"links":{"citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:e31aeac1d5fc1429a155f5814326352f87717c55f0612e95562d3627e5f454a7","observation_id":"038cb92d-130d-4dc9-a199-6acb3be0c56e","resolution":{"observed_at":"2026-07-30T12:14:14.472170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02167","last_updated":"2020-04-05T11:48:38Z","snapshot_observed_at":"2026-08-07T06:30:07.520205Z","submitted_at":"2020-04-05T11:48:38Z","title":"Change Rate Estimation and Optimal Freshness in Web Page Crawling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.02167","snapshot_observed_at":"2026-07-30T12:14:14.475832Z","title":"Change rate estimation and optimal freshness in web page crawling,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.475832Z"},"links":{"cited_paper":"/paper/2004.02167","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:e675e62f173040931cbdfc0bc92e432a8c44728198e2e4bba08db592cf825519","observation_id":"4f948e65-155c-4f5a-ac71-d22c33a529c1","resolution":{"observed_at":"2026-07-30T12:14:14.475832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-07-06T06:14:28.435222Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-07-30T12:14:14.480510Z","title":"AI2-THOR: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.480510Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:795dd946ea1057374eced057db6741ab31a76f12ecf4558d5da17c96a7d6e98e","observation_id":"3e4f9770-bba6-41e6-bb76-3e4e3004f343","resolution":{"observed_at":"2026-07-30T12:14:14.480510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-07-30T12:14:14.485021Z","title":"Learning transferable visual models from natural language super- vision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.485021Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:b7e5aad2d065e04bf2de778ea1eb686a3cf124fc3c1dc3f5c0ad0c2bc69701cd","observation_id":"41df3028-6e37-45a0-9438-187aa66e4df6","resolution":{"observed_at":"2026-07-30T12:14:14.485021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2607.23797."}