{"as_of":"2026-08-07T08:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa5d9ddeb9ef9823422ebdc42852b64641bb17f80e715ef4dd2e95f6dab2071b","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:52:02.912049Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.06291/citation-record","integrity":"/paper/2508.06291/integrity","json":"/paper/2508.06291/citation-record.json","paper":"/paper/2508.06291"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2105.14257","last_updated":"2024-11-04T03:01:27Z","snapshot_observed_at":"2026-08-06T00:31:00.527257Z","submitted_at":"2021-05-29T09:26:02Z","title":"Diffusion-Based Representation Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.14257","snapshot_observed_at":"2026-08-05T22:51:58.625256Z","title":"Abstreiter, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.625256Z"},"links":{"cited_paper":"/paper/2105.14257","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:76ddbe92bbf6aa0f2f8cb1438e5d11d3b32d9eb5637a021b90e167bf2347f8fb","observation_id":"05160327-a33a-4783-b10f-a190ec30a1fb","resolution":{"observed_at":"2026-08-05T22:51:58.625256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5555/3601993","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.330831Z","title":"Alayrac, J","venue":null,"work_id":"d4009524-1850-4432-b00a-f313a82f8ae3","year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.704240Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:2bee8436beb5a331e03cfe4d7c87e7fd46dbdd8b4a694314dc17a5fd4e2d0a1c","observation_id":"528fafec-561a-40c6-ad3e-35640d1e1379","resolution":{"observed_at":"2026-08-05T22:52:03.335006Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00505","last_updated":"2024-10-23T08:28:53Z","snapshot_observed_at":"2026-07-06T18:23:48.473551Z","submitted_at":"2024-06-01T17:27:34Z","title":"Improving Text Generation on Images with Synthetic Captions","version":2},"cited_work":{"arxiv_id":"2406.00505","doi":"10.48550/arxiv.2406.00505","metadata_source":"pith","pith_arxiv_id":"2406.00505","snapshot_observed_at":"2026-08-06T00:16:16.768632Z","title":"Improving Text Generation on Images with Synthetic Captions","venue":"cs.CV","work_id":"0bf7ed8b-ac98-4db1-af29-11b56b2cf6ef","year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.783693Z"},"links":{"cited_paper":"/paper/2406.00505","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:b914a16afe7c3c56588d0ae526f38c8146da37bc69e91ec0a4069c9a840abc74","observation_id":"a5ebf267-1979-4102-aafc-479f72b9dc79","resolution":{"observed_at":"2026-08-05T22:52:03.321025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/b100265","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.297069Z","title":null,"venue":null,"work_id":"3b949b70-e633-464a-b50c-b696405fa69c","year":2004},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.888198Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:3fd1b0d0826ffd3bc0fdeb19cebedab533c863596b2bca03695da1d48f88e8c4","observation_id":"405e3441-b98c-4ebd-a539-e2e10e5bb9c6","resolution":{"observed_at":"2026-08-05T22:52:03.301563Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14404","last_updated":"2024-01-25T18:59:57Z","snapshot_observed_at":"2026-08-06T14:37:40.501908Z","submitted_at":"2024-01-25T18:59:57Z","title":"Deconstructing Denoising Diffusion Models for Self-Supervised Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14404","snapshot_observed_at":"2026-08-05T22:51:58.987307Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.987307Z"},"links":{"cited_paper":"/paper/2401.14404","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a15bcb71ce022274913ab03dfeafb9eb1f0ef7cc9268db937080d3b59f94f56a","observation_id":"095642e9-b2f5-47e8-8e79-ec96c9570365","resolution":{"observed_at":"2026-08-05T22:51:58.987307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:51:59.235840Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.235840Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c0257010f5bdaa4ffb99f27406262eddf75b770736e11d6500b3cc9df860d796","observation_id":"5f8322b3-0eee-4d2a-bc12-df9b956183fd","resolution":{"observed_at":"2026-08-05T22:51:59.235840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-05T22:51:59.363572Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.363572Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a11749bc154fdca6a2900792e07fe3a420499bc40314ed94390643d98339e4d5","observation_id":"d2729ab0-bd8a-4b7b-8746-e419a18da89f","resolution":{"observed_at":"2026-08-05T22:51:59.363572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5171.30252","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.379611Z","title":"Dhamdhere, K","venue":null,"work_id":"4ce11b02-a3d7-429d-a568-aabd68639db7","year":2017},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.459803Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:4c8d9c363a0c910bb9c8a4ed48ed3e0f2588a078480acd004066b9386e2eec7b","observation_id":"f6d78abc-9b57-40ed-b722-1a7926081c45","resolution":{"observed_at":"2026-08-05T22:52:05.386012Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T22:51:59.555067Z","title":"Dubey, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.555067Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c4473b18a04707253f937adc2a3023b03f6ba74a9ee1f375aa37c28c53878379","observation_id":"586b3d61-0d1d-4049-9570-f0ee51f06620","resolution":{"observed_at":"2026-08-05T22:51:59.555067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.549293Z","title":null,"venue":null,"work_id":"8b46c63f-94cd-4b45-9278-7152a5dbe6df","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.668520Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:27488505f8a023169ddb46d33131f3509ec00b896930a3142dbc2c06fa9c2ddd","observation_id":"384c9425-441d-4b3d-b70b-fc4608192576","resolution":{"observed_at":"2026-08-05T22:52:05.553561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-07-06T09:30:47.469703Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-05T22:51:59.876708Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.876708Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:1083017500e30446dd06eec56154a9036a2aaa0d4e3e3fa707036304c74e361d","observation_id":"191deeac-e5bd-4e53-b92f-0fea7a6bfd05","resolution":{"observed_at":"2026-08-05T22:51:59.876708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:51:59.968188Z","title":"Hoque, V","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.968188Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:2e36b0e826f89e1ea9c052618a2a206db8ee4801c0433df932d50b3b0bfe1def","observation_id":"2d5b0fd4-b969-4c65-8e8c-7a3f9ad8b5e5","resolution":{"observed_at":"2026-08-05T22:51:59.968188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.071974Z","title":"Huang, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.071974Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:221b5bf34a699cd8c52f146926c5fadc8c45791fe9fc1bd20b9bcdab518a1bbb","observation_id":"e9814b17-8781-4d5a-a2d5-9298c85351ed","resolution":{"observed_at":"2026-08-05T22:52:00.071974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tvcg.2013.121","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.217331Z","title":"Jackson, T","venue":null,"work_id":"3b2f4a9e-8b3c-432a-9501-0349ad25fdb3","year":2013},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.146771Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:22f6e7c193dde737875ea5bd7dc2034646a2f54a0eaf389ca9567f97421420dc","observation_id":"bbda9b38-8b99-4ccd-96f4-beb8a42797a5","resolution":{"observed_at":"2026-08-05T22:52:03.221199Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.536181Z","title":"Jobard and W","venue":null,"work_id":"91ffc0c5-9653-403a-b17a-18249d2ca53b","year":1997},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.253577Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:4505690c9f788cf4266f72fd36c06cd3dc0699162094aa9af279250bbaf7bb43","observation_id":"a3901f68-3e02-46c5-bc5f-3962a3509379","resolution":{"observed_at":"2026-08-05T22:52:05.540123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.353944Z","title":"Karras, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.353944Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:f4b3379854bb59884407e8f062c3ff302690d58dfa815d5e589dfbdb63f82e47","observation_id":"41c945ca-1402-4f4b-b2b2-a0cd711386c9","resolution":{"observed_at":"2026-08-05T22:52:00.353944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w16-3639","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.194797Z","title":"Kumar, J","venue":null,"work_id":"f53d70e0-9931-4179-964e-3ba7f368dadc","year":2016},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.547660Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:d48d5fd2763d213d381e2dd9223f1567dba0d4e137f85ac498a32a163c34fa50","observation_id":"ccef9bf5-a6dd-4dc4-a3b4-e82989fb02fa","resolution":{"observed_at":"2026-08-05T22:52:03.198690Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.522578Z","title":"Lacasa, B","venue":null,"work_id":"ed918c1e-4786-49f2-93f8-7cbc2d74fabe","year":2008},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.685289Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ba73ce6ba5ecda04e7b98e7dee13998af828224a3e731aa34335c2d3fdad42c2","observation_id":"99f42bb9-a176-4b28-b9e2-4f389960c3bf","resolution":{"observed_at":"2026-08-05T22:52:05.526526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.805190Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.805190Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:834f0c526ae5e3f400aa6352c8c44719feba9243494d15e3d51417e36cb38c97","observation_id":"96f45a4d-05f7-4ca4-9d51-478ace4c45db","resolution":{"observed_at":"2026-08-05T22:52:00.805190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.905495Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.905495Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:f90625b42586ffade1833f0704adfe1521707cb9cee7a2e4ae3d6b7b5ce8619b","observation_id":"80f35b83-be4a-44e4-844d-112d0a4fa595","resolution":{"observed_at":"2026-08-05T22:52:00.905495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8454.36184","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.994407Z","title":null,"venue":null,"work_id":"37eb9c20-eeff-4613-a70c-ee1f99f5c2b6","year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.999791Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:4112b45d3ea3623cde02a057e6225e62c15985bf27546ac9fec2f2caff4147a1","observation_id":"5c637c6e-80db-439e-a9fb-7f20167fed60","resolution":{"observed_at":"2026-08-05T22:52:05.001505Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-05T22:52:01.107998Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.107998Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ca9b340e46a0f287191aa4c3690f9af6f2f8d3c3a8814bd4b756ae755e42e150","observation_id":"3e59b044-fbeb-49a9-a081-fc883f151de8","resolution":{"observed_at":"2026-08-05T22:52:01.107998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1117/12.2038253","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.157132Z","title":null,"venue":null,"work_id":"f0a09abe-0cec-4d10-a057-61121042e8c3","year":2014},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.210300Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c9e6c1b7712ef8176a6522ca438808d0848e96f31e77e34e567f50f988f70411","observation_id":"56242c7d-ad25-471c-a5ee-a866c0997b65","resolution":{"observed_at":"2026-08-05T22:52:03.161506Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.353603Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.353603Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:25daa1e74cca2c35e4ddc045d6b445d943f8291f16aeec1d83fd5fcea00f4ab2","observation_id":"c69fd755-8c84-48f4-a036-0c6c24d7900b","resolution":{"observed_at":"2026-08-05T22:52:01.353603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-05T22:52:01.417142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.417142Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:986a175e1276b3abcc8b80a9827633b400a86bb4e17cb33a9c0abc53d3464ba5","observation_id":"2140f980-9d52-4632-9c65-6f93faba483d","resolution":{"observed_at":"2026-08-05T22:52:01.417142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.501056Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.501056Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:6de277ce395904db1bbbae7ead8f9af9124280009a691c33391205624b7de316","observation_id":"a1c1e0ec-d4bf-4d36-95af-47374481f3af","resolution":{"observed_at":"2026-08-05T22:52:01.501056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.616863Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.616863Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:8ff4c978a5404c22d9db8bf20fa31aeecd7356f0e02df73994a9f01c4435a2d0","observation_id":"f6fb4dbe-605e-43ef-86bb-9e232a0efbc8","resolution":{"observed_at":"2026-08-05T22:52:01.616863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.689428Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.689428Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:35921c984986cf3907dc7c1550c4c56414bac5b54b92675f8433e939974a6ab6","observation_id":"0d1e28cb-6e52-4225-9e32-3b5903657c14","resolution":{"observed_at":"2026-08-05T22:52:01.689428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tvcg.2012.150","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.128480Z","title":"McLoughlin, M","venue":null,"work_id":"e6ec980b-925b-412b-98b2-d9ffb31d5ab5","year":2013},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.849421Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:f34e73380ffe40515145f164179be612e18158cdaf138fb7f95170fca73a77f3","observation_id":"f000941a-ce62-4205-944a-c0b045726404","resolution":{"observed_at":"2026-08-05T22:52:03.132593Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.951397Z","title":"McLoughlin, R","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.951397Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:31a67d78dad668a54d54fe499464fbfc83f5735e67660d36721d9f171c976576","observation_id":"a1938fa8-bfc7-4db3-86e7-ed6e237db82c","resolution":{"observed_at":"2026-08-05T22:52:01.951397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13774","last_updated":"2022-10-25T05:30:53Z","snapshot_observed_at":"2026-08-03T01:05:02.758230Z","submitted_at":"2022-10-25T05:30:53Z","title":"From Points to Functions: Infinite-dimensional Representations in Diffusion Models","version":1},"cited_work":{"arxiv_id":"2210.13774","doi":"10.48550/arxiv.2210.13774","metadata_source":"pith","pith_arxiv_id":"2210.13774","snapshot_observed_at":"2026-08-06T00:16:16.768632Z","title":"From Points to Functions: Infinite-dimensional Representations in Diffusion Models","venue":"cs.LG","work_id":"c234da30-6195-4856-bac6-d76cc4fc727d","year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.066914Z"},"links":{"cited_paper":"/paper/2210.13774","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:dd664c574e5bc0743bd2c0bf5c8ff60d61df6ee0c3bd6e258a5f547ec74bf76e","observation_id":"085d0d8d-9812-4b0f-b682-e8f1ef62ef4c","resolution":{"observed_at":"2026-08-05T22:52:03.118791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.173419Z","title":"Narechania, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.173419Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:9f025746430c8cf0ee0084ffab62d48b1b26118428d533a590eeea3ce4baf946","observation_id":"5dd6ef62-ae4d-4fcc-acf2-48508865bc24","resolution":{"observed_at":"2026-08-05T22:52:02.173419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2013.22979","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.457892Z","title":"Oeltze, D","venue":null,"work_id":"f532ea46-40a6-4a6b-bb3b-9adcba240197","year":2014},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.327673Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c8000e9d797fff765a5a4e609507d95f7cfb3286af4ef6db8f93744f13a8935a","observation_id":"c96a55a8-0e9f-4235-b575-011f874f7f90","resolution":{"observed_at":"2026-08-05T22:52:04.464559Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1647.57164","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.363693Z","title":"Osada, T","venue":null,"work_id":"8726dcc4-df6d-4d71-90b1-71661680b712","year":2002},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.447309Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:5071b1a5abc1e12cd28f40a94e1a3e65c5d3ad9991396b5b34b3142c43b1ec8a","observation_id":"4081bd70-8287-452e-b63c-3986c4659b3c","resolution":{"observed_at":"2026-08-05T22:52:04.370108Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.527294Z","title":"Preechakul, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.527294Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:fa52f31a2e922b5cc804d7046eb2b6cda451cb15b826fa79c53366765111d44d","observation_id":"9ba9603a-a7d3-45cb-8ae6-1ede230d6b9c","resolution":{"observed_at":"2026-08-05T22:52:02.527294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-05T22:52:02.653418Z","title":"Ramesh, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.653418Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:993eb0223a692023d4954e7978910a7a8e27d55e1e48b36e436cbc8e618e4a83","observation_id":"725a87a1-2138-4c38-93a8-61406a50411f","resolution":{"observed_at":"2026-08-05T22:52:02.653418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.509360Z","title":"Reimers and I","venue":null,"work_id":"3e203ac9-3148-41ab-b61e-e16f1b4ba76e","year":2019},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.779373Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:d92c17a63bc9c7392642d3d02ecf08af9c9bcb2e9752ac990cb0c4bf7ddd5980","observation_id":"c91733de-06e0-4320-85f5-8fea233d4b82","resolution":{"observed_at":"2026-08-05T22:52:05.513488Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.791111Z","title":"R¨ossl and H","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.791111Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:54d2430eb0a356ac76b79dd1fe0ae592bdacd3e84b6f6b0b4e68e543df5b2fe1","observation_id":"bcf0b40d-9797-47b9-b0bb-a36cd8b10563","resolution":{"observed_at":"2026-08-05T22:52:02.791111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.795484Z","title":"Sadlo, R","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.795484Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:015bc05063c509f22fb7ccc5035d3bd7bcabfa0ab4097bdd8383d4672130ee61","observation_id":"0f2ad04e-61c7-4394-b4d8-2f23bcd68b88","resolution":{"observed_at":"2026-08-05T22:52:02.795484Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tvcg.2006.104","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.060649Z","title":"Salzbrunn and G","venue":null,"work_id":"b22ada2d-e502-4d85-9d30-f65b46faaed6","year":2006},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.799589Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:8aafdbcf4dfbf818470d2a6414bb5f3eb0ecf04ee85ca43f128be3d32c80bc02","observation_id":"37f57a0c-f707-403c-956f-9ba50e1a8b54","resolution":{"observed_at":"2026-08-05T22:52:03.065560Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.493954Z","title":"Setlur, S","venue":null,"work_id":"adede44b-b50e-4fc4-82f5-3c6470f1586c","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.803584Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:3c0c518f62f5f52a6753977b5b6bdf21174489f0e7072c56caf962e057d09a84","observation_id":"9176a6be-f1ff-4890-888d-78b6e7a4126e","resolution":{"observed_at":"2026-08-05T22:52:05.499273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.479916Z","title":null,"venue":null,"work_id":"e2132722-45ae-4c93-b7cc-8f19c23d5628","year":2009},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.812575Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:9cbba6b0ae9211050cae3183b0ddca3ecf3ef060161576ff3aab28cf817d1d54","observation_id":"5433ea31-8052-4d36-9d1f-7e0fc66636c4","resolution":{"observed_at":"2026-08-05T22:52:05.483836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T22:52:02.816447Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.816447Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:e079af911dbc9c705eadd9466f9715355bd40cf518cdae1b726d507fac488769","observation_id":"3325b041-c60c-482b-ab5b-f9350b7ee4ad","resolution":{"observed_at":"2026-08-05T22:52:02.816447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-13544-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":null,"venue":"Lecture notes in computer science","work_id":"5f9d3e68-ab51-464a-8bad-363ec13f6a9c","year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.820860Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:6b6332c2a6d5a0fc66e6eaad85545f32a2054f4b448c4504c9703d10db8480b3","observation_id":"67b38167-65a6-42f6-b9a2-8be62c787774","resolution":{"observed_at":"2026-08-05T22:52:03.036679Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.824935Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.824935Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a7b85602b69a2160932b30677f2a625824e86895826e848f5a68a4bd411dd124","observation_id":"74e4acae-4cf2-471c-93de-339eeb6fcd87","resolution":{"observed_at":"2026-08-05T22:52:02.824935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.466780Z","title":null,"venue":null,"work_id":"7a5e7b0b-12c8-4ffb-a8c7-675429936842","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.829086Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:672e15b92a979f33b00e682664a5036193e35b44c7a0084f85f64be344e4b441","observation_id":"69e05da3-8985-4af2-9192-8013a0712e7c","resolution":{"observed_at":"2026-08-05T22:52:05.470757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.453111Z","title":null,"venue":null,"work_id":"409db07b-9cdb-4af2-91d0-6a12c3c436f1","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.838261Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:f9440c5c4827ed4dee6b214e2c9952ce04674cbaf2c3f6b9c968d3d9875d7ca2","observation_id":"1d8cedcb-ffc3-4763-af3e-46405e5f95e5","resolution":{"observed_at":"2026-08-05T22:52:05.457222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.439907Z","title":"Theisel, T","venue":null,"work_id":"cf5ef3d2-4303-49d2-afc6-f524e4d57cd0","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.846309Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:f1c06b4383a13f7f10e7828a158a3127cf157264d47108fbe99aa5dffc8947ca","observation_id":"089c3e6c-cff5-456c-a0aa-9f7422f674f9","resolution":{"observed_at":"2026-08-05T22:52:05.443865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-05T22:52:02.854536Z","title":"van den Oord, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.854536Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c032f68f29fc3707c2cd7bf752b58182696324ab49a9a8e133473252fac159da","observation_id":"c73eb095-6926-43ef-9c3b-5d6bdb56bdd4","resolution":{"observed_at":"2026-08-05T22:52:02.854536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.859225Z","title":"Vincent, H","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.859225Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c314459033d93985c32a0a85c7a79dc8b3e25771239def640482bae2bbd7b3a2","observation_id":"cfd044a6-1d2b-47dd-af23-479ea2914f43","resolution":{"observed_at":"2026-08-05T22:52:02.859225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4938.35258","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.829219Z","title":"Wang and P","venue":null,"work_id":"7daa8d11-f206-4df5-bd22-95507e7d64cb","year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.863669Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:81a42283e5c4b904be10043aa80eefd0634d71d635c27d864dbaf5ddfbb1fb64","observation_id":"04794417-ee7b-443e-97a8-b8bf905d9fd9","resolution":{"observed_at":"2026-08-05T22:52:03.836049Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/cgf.12990","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.994558Z","title":null,"venue":null,"work_id":"ad2c4069-25a4-480f-8292-ac77c376ab6d","year":2017},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.867669Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:b8b3414cbce9fb3b136662b8442d0405ec5588fb84631239f06936517cad2155","observation_id":"725fa13d-fc1f-4c08-b8e1-a19f6906c630","resolution":{"observed_at":"2026-08-05T22:52:02.999019Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.872232Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.872232Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ef606c23c1690700e73c8a19f65688545bad9437ab4fd1c88b904a8cf76b9416","observation_id":"388a49ad-e48c-4275-8a31-0173f1254cb7","resolution":{"observed_at":"2026-08-05T22:52:02.872232Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.876029Z","title":"Xiang, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.876029Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ceeafff9984e466ee10de44297ed1c2dd235794dc2e00943defb1cdaffe5d93c","observation_id":"e959404a-e7e9-45ca-b399-94bf6c77245e","resolution":{"observed_at":"2026-08-05T22:52:02.876029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.880031Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.880031Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:429b849c4e9184f305672e0bc5c9e85ef16805ed27c84941f46a4a513a1e198b","observation_id":"5c2b46b4-2c80-4ae8-b844-19603d8a2c68","resolution":{"observed_at":"2026-08-05T22:52:02.880031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.425935Z","title":null,"venue":null,"work_id":"b84f8732-b967-4ca4-b37b-35406bbd589c","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.884285Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:715016f4b0dee6c50560d166ddb44197c8cc591d54c6f4601ce6781997f4d517","observation_id":"d5278393-5150-4e34-85d8-35ae5387c200","resolution":{"observed_at":"2026-08-05T22:52:05.430468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-05T22:52:02.892489Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.892489Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a05b095d43e8029c9d6b9b582c776dff4cbc276c5f63c2005750f012db3ad6b1","observation_id":"da9e81ec-a28b-4294-8223-8b7cfdf67831","resolution":{"observed_at":"2026-08-05T22:52:02.892489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.900666Z","title":"Yu and C","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.900666Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:876d9b1cb9ec48cb0ce6f05ce24950a23ef9e4c0fb867116d970bb30031f5d83","observation_id":"67e4dc92-e37f-46f6-a16f-ecc40b64df90","resolution":{"observed_at":"2026-08-05T22:52:02.900666Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.904581Z","title":"Zafar, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.904581Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:34c4870710874be3accd5756023512c105e710d455e09ec4ffa971ef4d4fa3b6","observation_id":"00de35ec-6b3b-4943-91eb-c8364ac7eb3a","resolution":{"observed_at":"2026-08-05T22:52:02.904581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.908443Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.908443Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:725631e73a3a611b9947f1232cd6cb096890b6c93d6b8fa61a04a738acd8394f","observation_id":"50e767c0-8b87-477c-9575-adde5d8dd6bf","resolution":{"observed_at":"2026-08-05T22:52:02.908443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.912049Z","title":"Hidden Dims","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.912049Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:df4fa0d3b3ecab1b25a50d53e3f4f59c7d6ce720feeb10ea57e4e78d2c64c8ae","observation_id":"750eb1c9-9de0-4015-88fa-c52513d2ab1e","resolution":{"observed_at":"2026-08-05T22:52:02.912049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-72698-9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":null,"venue":"Lecture notes in computer science","work_id":"892ffbf2-8420-47c2-aeb9-532c2337541d","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.888493Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:aa9f3b9298c7062ac760737c6a980d175dec2ff218686388a9a1835aac50b853","observation_id":"ee7fe5d2-b988-4f07-8439-7d071d9f3008","resolution":{"observed_at":"2026-08-05T22:52:02.974957Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.808077Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":377,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.808077Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:68ab4fafdfc69193766a32511b1966bdacd53758672dab8cfd4b902b53b0d83c","observation_id":"78585923-991a-4b91-bf9b-01e056f2e9b0","resolution":{"observed_at":"2026-08-05T22:52:02.808077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12503","last_updated":"2020-03-27T16:11:57Z","snapshot_observed_at":"2026-08-06T07:19:21.081889Z","submitted_at":"2020-03-27T16:11:57Z","title":"Measurement of cumulants of conserved charge multiplicity distributions in Au+Au collisions from the STAR experiment","version":1},"cited_work":{"arxiv_id":"2003.12503","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.12503","snapshot_observed_at":"2026-08-05T22:52:03.933849Z","title":"Measurement of cumulants of conserved charge multiplicity distributions in Au+Au collisions from the STAR experiment","venue":"nucl-ex","work_id":"42b6fa98-2596-47d8-8052-206121675c82","year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.850304Z"},"links":{"cited_paper":"/paper/2003.12503","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:84153195f27e428d10551dc5beab85af8ce3d6e0bee4bda397aa102d894c1646","observation_id":"77524a24-9964-40d4-bef0-6abb4287a82f","resolution":{"observed_at":"2026-08-05T22:52:03.938528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.833940Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.833940Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:51c8c76c193e393be33ea4b029521fbd6f7260f6baf4a95941b7f4c984b9509e","observation_id":"a1f7c46e-1fcc-4e29-b72d-6b6966efa832","resolution":{"observed_at":"2026-08-05T22:52:02.833940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2015.24402","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.004964Z","title":null,"venue":null,"work_id":"d77e1276-9b4c-4f4b-b07b-a96eb9663a87","year":2015},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.842254Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ada502cfdab78b9888c093e50846f1a49c4258b1228bffc728b889967d080cff","observation_id":"c1373ecd-8f88-4738-a44c-b1772f6c1256","resolution":{"observed_at":"2026-08-05T22:52:04.011778Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28802","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.296321Z","title":null,"venue":null,"work_id":"265ac78a-84a5-4184-8cc6-d31a1da9caa6","year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.728978Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:7f7c557f246879ff2a50c039436fbbae7b4029a3f5945a41735134608e62be2b","observation_id":"a582a220-5401-4d9d-8675-5aa8db575e37","resolution":{"observed_at":"2026-08-05T22:52:05.302901Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-05T22:52:02.896766Z","title":"doi: 10.48550/arXiv.2306.13549","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.896766Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:b68a3be052673779c931a7480d1863810f070f2f248e31ccb72bfb90f4bfd54c","observation_id":"afebf6c3-5526-4e2d-acd1-2a3442ad7e9f","resolution":{"observed_at":"2026-08-05T22:52:02.896766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.562185Z","title":null,"venue":null,"work_id":"53edd71a-c0c3-4333-899d-c6f80dbb63f4","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.052059Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:32c3177e85dea019eda16ecc739a26bd25c6ec3d3d58a1aa91630b951cc52289","observation_id":"ac1bb145-e34e-48bb-a165-3a48cb2d25f3","resolution":{"observed_at":"2026-08-05T22:52:05.565826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14404","last_updated":"2024-01-25T18:59:57Z","snapshot_observed_at":"2026-08-06T14:37:40.501908Z","submitted_at":"2024-01-25T18:59:57Z","title":"Deconstructing Denoising Diffusion Models for Self-Supervised Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14404","snapshot_observed_at":"2026-08-05T22:51:59.142839Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.142839Z"},"links":{"cited_paper":"/paper/2401.14404","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:1470d5dbaa70a1772dce1c23cc3161faff9951813bb62ddf355c8b499096c30b","observation_id":"1a260cd4-33ea-47ce-8f77-50b4789b6c0a","resolution":{"observed_at":"2026-08-05T22:51:59.142839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":5,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":42,"verified_exact":13,"verified_fuzzy":4},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2508.06291."}