{"as_of":"2026-08-09T08:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f266f5221b51e50e6b2dea4b291ec7ef42d343cb5364a7277ca49b1065fbe26b","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:13:52.763538Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T12:14:14.366207Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.16173","snapshot_observed_at":"2026-07-30T12:14:14.366207Z","title":"Vision-Language-Motion Maps: An open- vocabulary, uncertainty-aware, queryable motion attribute for 3D scene maps,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23797","last_updated":"2026-07-26T18:49:54Z","snapshot_observed_at":"2026-08-09T06:05:58.241433Z","submitted_at":"2026-07-26T18:49:54Z","title":"Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T12:14:14.366207Z"},"links":{"cited_paper":"/paper/2607.16173","citing_paper":"/paper/2607.23797"},"observation_digest":"sha256:d2f1305296378e12a8c2b5ff4e9d85b467314346e274ef04622e0136aab0add8","observation_id":"b7c95084-d7f2-4d89-9796-8a04a58e61f2","resolution":{"observed_at":"2026-07-30T12:14:14.366207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.16173/citation-record","integrity":"/paper/2607.16173/integrity","json":"/paper/2607.16173/citation-record.json","paper":"/paper/2607.16173"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.05714","last_updated":"2023-03-08T10:30:41Z","snapshot_observed_at":"2026-07-06T14:03:49.583141Z","submitted_at":"2022-10-11T18:13:20Z","title":"Visual Language Maps for Robot Navigation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05714","snapshot_observed_at":"2026-08-01T21:13:49.950248Z","title":"Visual language maps for robot navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:49.950248Z"},"links":{"cited_paper":"/paper/2210.05714","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:2f7740714d55404c509582ec8ecd8e63e0ec3ec58931a2331e70cdd38bb53eb6","observation_id":"30eeea7a-9fc6-485e-a989-41cd59a25270","resolution":{"observed_at":"2026-08-01T21:13:49.950248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07241","last_updated":"2023-10-23T14:56:15Z","snapshot_observed_at":"2026-07-06T14:51:48.920020Z","submitted_at":"2023-02-14T18:40:26Z","title":"ConceptFusion: Open-set Multimodal 3D Mapping","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07241","snapshot_observed_at":"2026-08-01T21:13:50.013591Z","title":"Conceptfusion: Open-set multimodal 3d mapping,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.013591Z"},"links":{"cited_paper":"/paper/2302.07241","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:916aa77d883d08868c6a1c2592c2fbafedb1421838633775134519b34308b706","observation_id":"b7a6dc4a-7f32-4ccc-a47a-e7fe912f515d","resolution":{"observed_at":"2026-08-01T21:13:50.013591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16650","last_updated":"2023-09-28T17:53:38Z","snapshot_observed_at":"2026-08-09T02:12:31.765619Z","submitted_at":"2023-09-28T17:53:38Z","title":"ConceptGraphs: Open-Vocabulary 3D Scene Graphs for Perception and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16650","snapshot_observed_at":"2026-08-01T21:13:50.089551Z","title":"Conceptgraphs: Open-vocabulary 3d scene graphs for perception and planning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.089551Z"},"links":{"cited_paper":"/paper/2309.16650","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:ea3c78dceb9e5cee4a195e7553e2db1ae158fc8869daf2621ff73084f99eb827","observation_id":"7bdb642c-c251-4343-ae37-4cfb2e6a0efd","resolution":{"observed_at":"2026-08-01T21:13:50.089551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17846","last_updated":"2024-06-03T17:12:25Z","snapshot_observed_at":"2026-08-03T07:21:49.675852Z","submitted_at":"2024-03-26T16:36:43Z","title":"Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17846","snapshot_observed_at":"2026-08-01T21:13:50.219612Z","title":"Hi- erarchical open-vocabulary 3d scene graphs for language-grounded robot navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.219612Z"},"links":{"cited_paper":"/paper/2403.17846","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:512bc36c5b9cfbce53602d9219f4d2dfaa064370e7faf4a21ff7ac518f808f28","observation_id":"fefb3073-054c-447e-af54-e524089180ee","resolution":{"observed_at":"2026-08-01T21:13:50.219612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04999","last_updated":"2025-05-29T13:57:04Z","snapshot_observed_at":"2026-07-06T19:46:54.707852Z","submitted_at":"2024-11-07T18:59:27Z","title":"DynaMem: Online Dynamic Spatio-Semantic Memory for Open World Mobile Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04999","snapshot_observed_at":"2026-08-01T21:13:50.373103Z","title":"Dynamem: Online dynamic spatio-semantic memory for open world mobile manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.373103Z"},"links":{"cited_paper":"/paper/2411.04999","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:b5d67782735e8a271657f02219ce943c807f664a85a20f2fbf90efc25b069d61","observation_id":"26923bb0-3e31-4d13-8b5b-d8f77f4bf5fa","resolution":{"observed_at":"2026-08-01T21:13:50.373103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11989","last_updated":"2025-03-19T03:24:54Z","snapshot_observed_at":"2026-08-05T21:54:24.161621Z","submitted_at":"2024-10-15T18:52:22Z","title":"Dynamic Open-Vocabulary 3D Scene Graphs for Long-term Language-Guided Mobile Manipulation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11989","snapshot_observed_at":"2026-08-01T21:13:50.547384Z","title":"Dynamic open-vocabulary 3d scene graphs for long-term language- guided mobile manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.547384Z"},"links":{"cited_paper":"/paper/2410.11989","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:56ff96872f01a2afc9d2145dc9b3d7ab569fd45710936b4cead130426710d6a7","observation_id":"d87039bf-fa9d-458d-9ebd-e316d3c1a231","resolution":{"observed_at":"2026-08-01T21:13:50.547384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:13:50.623269Z","title":"Dualmap: Online open- vocabulary semantic mapping for natural language navigation in dynamic changing scenes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.623269Z"},"links":{"citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:593010c1d6c179da3bc77c39311be606304f5465c013dbd293fc3255e7fe3192","observation_id":"1b02daae-4568-48de-a1f5-b755373312c2","resolution":{"observed_at":"2026-08-01T21:13:50.623269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13817","last_updated":"2024-05-20T13:11:48Z","snapshot_observed_at":"2026-07-06T17:33:25.448648Z","submitted_at":"2024-02-21T13:55:53Z","title":"Khronos: A Unified Approach for Spatio-Temporal Metric-Semantic SLAM in Dynamic Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13817","snapshot_observed_at":"2026-08-01T21:13:50.801250Z","title":"Khronos: A unified approach for spatio-temporal metric-semantic slam in dynamic environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.801250Z"},"links":{"cited_paper":"/paper/2402.13817","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:e9d2ab581f41db9c8a0e400a0f07cd1fa6e90aa2c05b41649cec3b67f00e72b4","observation_id":"f8815ac4-4b23-48d4-95d6-66347d85a62f","resolution":{"observed_at":"2026-08-01T21:13:50.801250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08355","last_updated":"2017-06-26T13:16:57Z","snapshot_observed_at":"2026-07-06T05:48:25.520994Z","submitted_at":"2017-06-26T13:16:57Z","title":"Deep Semantic Classification for 3D LiDAR Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08355","snapshot_observed_at":"2026-08-01T21:13:50.996823Z","title":"Deep semantic classi- fication for 3d lidar data,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:50.996823Z"},"links":{"cited_paper":"/paper/1706.08355","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:3d81b9143fa3e8bb7da0e1b803be4030da99205c18021a36aec0f659c5388536","observation_id":"d055aae5-268f-4e9c-9c47-4fd4264cc303","resolution":{"observed_at":"2026-08-01T21:13:50.996823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08727","last_updated":"2024-11-13T16:09:04Z","snapshot_observed_at":"2026-07-06T19:49:48.427067Z","submitted_at":"2024-11-13T16:09:04Z","title":"Voxeland: Probabilistic Instance-Aware Semantic Mapping with Evidence-based Uncertainty Quantification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08727","snapshot_observed_at":"2026-08-01T21:13:51.195880Z","title":"V oxeland: Probabilistic instance-aware seman- tic mapping with evidence-based uncertainty quantification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:51.195880Z"},"links":{"cited_paper":"/paper/2411.08727","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:0cd827b3332df2e4f4871f117b0963b4ff7e01a65a837ff79f742c2f9dfd38e6","observation_id":"80b07dd2-0d3f-4850-9a76-516a7efa1749","resolution":{"observed_at":"2026-08-01T21:13:51.195880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-01T21:13:51.355438Z","title":"Learning transferable visual models from natu- ral language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:51.355438Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:5851c17776d3549dd8b9651651833dd4fac9017b7dc4e20a5ad4d4933d86aa34","observation_id":"b7b49893-e786-40b0-ae57-ddef995d0a54","resolution":{"observed_at":"2026-08-01T21:13:51.355438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:13:51.530120Z","title":"Openclip,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:51.530120Z"},"links":{"citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:32750bc59a8f67472036a5e68b9599ad6650666e323507bf0570ec42d27721cb","observation_id":"b55aec02-b863-40f7-8d5a-399c915b24bb","resolution":{"observed_at":"2026-08-01T21:13:51.530120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01071","last_updated":"2022-07-27T04:42:54Z","snapshot_observed_at":"2026-07-06T12:14:32.172917Z","submitted_at":"2021-12-02T09:23:01Z","title":"Extract Free Dense Labels from CLIP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01071","snapshot_observed_at":"2026-08-01T21:13:51.676631Z","title":"Extract free dense labels from clip,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:51.676631Z"},"links":{"cited_paper":"/paper/2112.01071","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:a72de200b94decb7926bbb80bb39051ae592aaebfb9ce19945240eee0911ec06","observation_id":"4dfce707-97ec-4cb2-a754-e93a0b49b615","resolution":{"observed_at":"2026-08-01T21:13:51.676631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12039","last_updated":"2020-08-25T15:49:48Z","snapshot_observed_at":"2026-08-09T04:49:41.475801Z","submitted_at":"2020-03-26T17:12:42Z","title":"RAFT: Recurrent All-Pairs Field Transforms for Optical Flow","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.12039","snapshot_observed_at":"2026-08-01T21:13:51.847543Z","title":"Raft: Recurrent all-pairs field transforms for optical flow,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:51.847543Z"},"links":{"cited_paper":"/paper/2003.12039","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:abe9776b84025715b6aef791940eb51d79691b9c2f0a9e2e4a3d6fd39f32c78d","observation_id":"2028b12e-cabd-455b-a025-8a0cd44da14d","resolution":{"observed_at":"2026-08-01T21:13:51.847543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:13:52.034420Z","title":"Modeling kinect sensor noise for improved 3d reconstruction and tracking,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:52.034420Z"},"links":{"citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:31c43152026f4b3eefde914725e891a85478d429268079d631910eea03b07ced","observation_id":"2e267044-1e13-47a6-b932-6c80fd0ffbef","resolution":{"observed_at":"2026-08-01T21:13:52.034420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-07-06T06:14:28.435222Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-01T21:13:52.235429Z","title":"AI2-THOR: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:52.235429Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:ac6410493a4b1da91b735d8715b451829224cc2dca9a9fd103e28e58179da127","observation_id":"768126de-7d00-4913-bc8d-56e98d1db3ab","resolution":{"observed_at":"2026-08-01T21:13:52.235429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:13:52.413601Z","title":"A benchmark for the evaluation of rgb-d slam systems,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:52.413601Z"},"links":{"citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:6106763ce62e4134b91e563f1c7576266019c929cb8a406a520e1cbf79c31349","observation_id":"04158623-efd6-4585-afe6-4067be4e5557","resolution":{"observed_at":"2026-08-01T21:13:52.413601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:13:52.565372Z","title":"Refusion: 3d reconstruction in dynamic environments for rgb-d cameras exploiting residuals,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:52.565372Z"},"links":{"citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:b4b07ef0cd729e1bb9aaef94289072e8b30d537f8df1cc45566a31370aeb6194","observation_id":"94a7f404-ba5d-48db-89ff-d968df360d96","resolution":{"observed_at":"2026-08-01T21:13:52.565372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:13:52.763538Z","title":"On calibration of modern neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T21:13:52.763538Z"},"links":{"citing_paper":"/paper/2607.16173"},"observation_digest":"sha256:a4ebad192544ad2aef84d3e035e0815558c9ffa961c1c5c8e790661dc2b68ab7","observation_id":"e7cf8b46-e9ac-471a-9997-0234093a9120","resolution":{"observed_at":"2026-08-01T21:13:52.763538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16173","last_updated":"2026-07-17T17:53:13Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T06:05:46.704586Z","submitted_at":"2026-07-17T17:53:13Z","title":"Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 1 inbound Pith citation observation for arXiv:2607.16173."}