{"as_of":"2026-08-23T00:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b6074f23b920b935a92b74607c98cac7d57f07cb5950a60c6619793bf583f9b","coverage":[{"denominator":93,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":93,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:44:48.021916Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T22:45:19.070143Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.01341","snapshot_observed_at":"2026-07-30T22:45:19.070143Z","title":"Street- level geolocalization using multimodal large language mod- els and retrieval-augmented generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24856","last_updated":"2026-07-26T02:51:53Z","snapshot_observed_at":"2026-08-19T08:33:04.768052Z","submitted_at":"2026-07-26T02:51:53Z","title":"DisasterTD: Disaster Toponym Disambiguation Using Multimodal LLMs and Cross-View Geolocalization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-30T22:45:19.070143Z"},"links":{"cited_paper":"/paper/2509.01341","citing_paper":"/paper/2607.24856"},"observation_digest":"sha256:a245a9efed10ed0900dfc437e9f8e6bdcc2aab0ec9402d26014075b06dcb5318","observation_id":"a3136a66-8a2a-4914-8b06-1b4b3ce1a573","resolution":{"observed_at":"2026-07-30T22:45:19.070143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.01341/citation-record","integrity":"/paper/2509.01341/integrity","json":"/paper/2509.01341/citation-record.json","paper":"/paper/2509.01341"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:40.981376Z","title":"Revisiting im2gps in the deep learning era,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:40.981376Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:99782a52805f6a2ba136f1120dc01d61545255169c9b67cf982a4cce2a5abd26","observation_id":"5fa19d0f-9669-44ec-a21a-64d7e2a13799","resolution":{"observed_at":"2026-08-05T12:44:40.981376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.025665Z","title":"Using twitter data to monitor natural disaster social dynamics: A recurrent neural net- work approach with word embeddings and kernel density estimation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.025665Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ac76c3e572531bd5a1b5bf32c7e49d7a089a0f55f3991e5131c24f514813f004","observation_id":"b76d9477-03af-47d1-962f-07c90233d94a","resolution":{"observed_at":"2026-08-05T12:44:41.025665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.125391Z","title":"Suwaileh, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.125391Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ff987e6f8594531afe2af18d29475bd1e8535b98997949a84a6b62994393d0eb","observation_id":"024f83b7-67ec-44e3-a84b-5d45531c9e60","resolution":{"observed_at":"2026-08-05T12:44:41.125391Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.181710Z","title":"True lies in geospatial big data: detecting location spoofing in social media,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.181710Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:a2a988b16e18982b9e60a6c30ca2c3b569e154762c4fc358d33856539bce63e0","observation_id":"a8c7841b-d39d-45a9-9f6c-f9ae8a5d0677","resolution":{"observed_at":"2026-08-05T12:44:41.181710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.277456Z","title":"Geotagging text content with language models and feature mining,","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.277456Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:b1b6dfb05082acff61f7ce6a0ae0220bfaa33a289f3f52d1c02d5ed8f3146505","observation_id":"16bea4e7-f42d-407a-97b7-b479f2fc9f79","resolution":{"observed_at":"2026-08-05T12:44:41.277456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.345060Z","title":"Geolocalization and navigation by visible light communication to ad- dress automated logistics control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.345060Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:cd974d619b5a3b78b1dac0df2c6d035dcd4c9907a09b07932eba109b5b57a596","observation_id":"771aeff2-9206-43e8-b5fc-a7447a7b8b91","resolution":{"observed_at":"2026-08-05T12:44:41.345060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.419168Z","title":"Ubiquitous real-time geo- spatial localization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.419168Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:b9b85e3e3178b3dc7158c8b1f2dfc86a7c602bd15eab466b68893810c54421e1","observation_id":"b7229520-d602-4f2f-8664-efb844d2a8ec","resolution":{"observed_at":"2026-08-05T12:44:41.419168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.522988Z","title":"Single-image localisation using 3d models: Combining hierarchical edge maps and semantic segmentation for domain adap- tation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.522988Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:9d49051f78a0e2e106e959fa93a7c472f5d365a86854ab527d233aa1c16ee572","observation_id":"88b0bc38-78ea-455d-9970-9d8483262d5c","resolution":{"observed_at":"2026-08-05T12:44:41.522988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.614335Z","title":"Analysing gender differences in the perceived safety from street view imagery,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.614335Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:40c8856206cc8490d508a4baa1ed155e50167fa2b4b14319046f55ab85a2a0f9","observation_id":"4bbe7932-c350-4647-829b-9ebf811bfc87","resolution":{"observed_at":"2026-08-05T12:44:41.614335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.726845Z","title":"Multi-level urban street representation with street-view imagery and hybrid se- mantic graph,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.726845Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:1830a6c39afb2ad2ebf62e7ef9e3cbe73830934a9b2a167faf317570d0b6e3cb","observation_id":"3f74abc1-638c-4319-8af3-9e05efa59f49","resolution":{"observed_at":"2026-08-05T12:44:41.726845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.790355Z","title":"Street view imagery in urban analytics and gis: A review,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.790355Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:1ebb08e5d51434f813df67b0a7e668b9cd66bc817b49c687e60b122b280a584b","observation_id":"3506388f-4059-4465-a4bf-e7a20ac0cac1","resolution":{"observed_at":"2026-08-05T12:44:41.790355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.888055Z","title":"Global streetscapes – a comprehensive dataset of 10 million street-level images across 688 cities for urban science and analytics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.888055Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ae1d76a8eebbdb017ba8a4712dca2c425a03b63e7920478cddacee75cc584033","observation_id":"081a131e-4228-4da7-ba8b-f11797a4bbc9","resolution":{"observed_at":"2026-08-05T12:44:41.888055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18873","last_updated":"2024-04-29T17:06:44Z","snapshot_observed_at":"2026-08-16T13:56:53.501271Z","submitted_at":"2024-04-29T17:06:44Z","title":"OpenStreetView-5M: The Many Roads to Global Visual Geolocation","version":1},"cited_work":{"arxiv_id":"2404.18873","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.18873","snapshot_observed_at":"2026-08-05T12:44:48.674617Z","title":"OpenStreetView-5M: The Many Roads to Global Visual Geolocation","venue":"cs.CV","work_id":"6cb75716-eebc-45d2-8b33-ca689918b469","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.969293Z"},"links":{"cited_paper":"/paper/2404.18873","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:73a2c4e002c6da2746503b50b1e088c74c1df97183ab116756511389919fe384","observation_id":"fce76d2a-e0d6-4691-badb-072bdf50e4ad","resolution":{"observed_at":"2026-08-05T12:44:48.742246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:56.469926Z","title":"Are these from the same place? seeing the unseen in cross-view image geo- localization,","venue":null,"work_id":"5431defa-8750-4109-8a2a-d25817feb026","year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.079359Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:f14b5945802f854da5d86ad70c25298243bec8f2337a54c5ca6d7782e8960a6c","observation_id":"4808d3e5-590b-4cf0-acf1-8310d6240795","resolution":{"observed_at":"2026-08-05T12:44:56.540922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:56.301150Z","title":"Geolocation by light: accuracy and precision affected by environmen- tal factors,","venue":null,"work_id":"b10b88d0-4942-4904-97f6-25ef9886e0d6","year":2012},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.124308Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ed54f389695f44375e77e58d5bcac8801e0eff9d7e34633d9fed12af4c91d342","observation_id":"b4f6c5bd-aff8-419d-91e7-70419b6007a0","resolution":{"observed_at":"2026-08-05T12:44:56.377224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:56.172315Z","title":"Season-invariant gnss-denied visual localization for uavs,","venue":null,"work_id":"63f0b7d4-8e95-4da7-8184-7a0ae7469897","year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.214980Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:10dc9def507fffd2aa8e8f6088e0f9cf61745a50c840510c71701bebf1a294c6","observation_id":"36f95602-e7d4-4427-af8b-057c74f1f65f","resolution":{"observed_at":"2026-08-05T12:44:56.217342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-05T12:44:42.305139Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.305139Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:9556f5f4db47577448a156e1783d624d926ec97a616f27d293864db616904d14","observation_id":"43e8d0de-3932-4722-b3f0-0c164c4545df","resolution":{"observed_at":"2026-08-05T12:44:42.305139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:55.973781Z","title":"A survey on multimodal large language models,","venue":null,"work_id":"374da244-c3f1-4065-9b85-2294cd38bb7b","year":null},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.358126Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:cf4b424565d666033fb78b01669c66f7f65796696fe49daefb73005a994c95eb","observation_id":"e79b1727-a3c1-4020-bac0-4b1d97dc7c64","resolution":{"observed_at":"2026-08-05T12:44:56.082477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11401","last_updated":"2021-04-12T15:42:18Z","snapshot_observed_at":"2026-08-07T05:44:30.677502Z","submitted_at":"2020-05-22T21:34:34Z","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11401","snapshot_observed_at":"2026-08-05T12:44:42.489002Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.489002Z"},"links":{"cited_paper":"/paper/2005.11401","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:131e454c60f83b7d585437b6ddf0d5f140f4047675aedf7dbeb67d3a2d2dcfca","observation_id":"e51b2922-6f19-4764-98cc-882bd478306d","resolution":{"observed_at":"2026-08-05T12:44:42.489002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-05T12:44:42.563018Z","title":"Retrieval-augmented generation for large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.563018Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:cd51e4bad7919797f8b36f36fb3a5dc202ae838060e6421d919a1754ba7dc3ec","observation_id":"493c2c24-7bf3-498d-8abd-56504bbe5e54","resolution":{"observed_at":"2026-08-05T12:44:42.563018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:55.770327Z","title":"A review on large language models: Architectures, applications, taxonomies, open issues and challenges,","venue":null,"work_id":"c166575a-d968-4cc4-9a51-2a80657d02d0","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.666903Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:3179b4425c9e14f433ec1498e16107594a09f11dee9e83d5cf0ba6f8d988c25e","observation_id":"9430a234-73f3-4c85-bddf-46fa60b38f47","resolution":{"observed_at":"2026-08-05T12:44:55.874716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00494","last_updated":"2024-09-04T18:00:53Z","snapshot_observed_at":"2026-08-16T13:22:25.110591Z","submitted_at":"2024-08-31T16:14:42Z","title":"GenAI-powered Multi-Agent Paradigm for Smart Urban Mobility: Opportunities and Challenges for Integrating Large Language Models (LLMs) and Retrieval-Augmented Generation (RAG) with Intelligent Transportation Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00494","snapshot_observed_at":"2026-08-05T12:44:42.707554Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.707554Z"},"links":{"cited_paper":"/paper/2409.00494","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:7f4be655aaa30a02043f96351fe6b84c7c6fdf29817b59fdc3efde4975366406","observation_id":"b73bf6fc-580c-496f-89ab-2870deed2639","resolution":{"observed_at":"2026-08-05T12:44:42.707554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:55.586324Z","title":"Im2gps: estimating geographic information from a single image,","venue":null,"work_id":"d861769b-b1b2-42de-afb1-9d55ff5a72d5","year":2008},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.772464Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:f9f8481b137c5c20fd3c22bc7937bb425377ed4d4a0ddba6ed656344db5933b5","observation_id":"6f273de2-1013-4605-9588-b66a2a80c294","resolution":{"observed_at":"2026-08-05T12:44:55.670950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:55.421241Z","title":"Planet-photo ge- olocation with convolutional neural networks,","venue":null,"work_id":"a276504f-40ca-4634-b37f-fea45cd13f4e","year":2016},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.841226Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:42784ea6ee633f73154f2acf53a2142a4da15d1094fb03bb17991366661d4ed3","observation_id":"173adaf7-efd6-450b-b988-2678e6a4b668","resolution":{"observed_at":"2026-08-05T12:44:55.530668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:42.928094Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.928094Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:37fe939c4676c43dd507f330ab47f87d06ead2c131b44acb67a65def9bbdc572","observation_id":"8cbb97f6-b013-4b58-a99b-ce140c52c0b6","resolution":{"observed_at":"2026-08-05T12:44:42.928094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:55.232963Z","title":"Sigmoid loss for language image pre-training,","venue":null,"work_id":"f0be34fe-d241-4112-9a95-b17e8b6288d5","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.019903Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:8460f4264b3fcb9277236c81786c9451dc7b616713a62b98c1971f0cc08dc167","observation_id":"27b08048-bb3a-4248-977f-078764eb2284","resolution":{"observed_at":"2026-08-05T12:44:55.322009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:55.094155Z","title":"Blip-2: Boot- strapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"9722c14f-2f5e-4444-b010-c08d21098dd8","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.105115Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:688007e68cbf642e40b166aa8101b52106993c97e1b8031199819e36acdeb4bd","observation_id":"1f1bb282-a6e3-4cfc-aa3b-c25e37926df8","resolution":{"observed_at":"2026-08-05T12:44:55.149007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T12:44:43.178571Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.178571Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:c047e540bc6fd2610716ac102e8bab311b0900f37f26e9d6c69cad2bb759bf97","observation_id":"0c04a5b3-2919-48d1-b83b-cb4c7429751f","resolution":{"observed_at":"2026-08-05T12:44:43.178571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-08-19T04:42:40.974785Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-05T12:44:43.231966Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.231966Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:66ebee602aa4365f7c8ec10621d1f96e492370f355171ae96d002bea7417ebd2","observation_id":"6d0e8013-5120-4b86-a4bf-7d3e14a16775","resolution":{"observed_at":"2026-08-05T12:44:43.231966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-05T12:44:43.306692Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.306692Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:0f34ab36793b8c863862ca63a024d24f2f36e1becec2288edc1d677d8b73abed","observation_id":"de1812bf-cf53-49e2-9d21-5a86bc984f1a","resolution":{"observed_at":"2026-08-05T12:44:43.306692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-05T12:44:43.365779Z","title":"Roberta: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.365779Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:61ee6f038c6cf34e9edcb1e47b4c943caae52a60ab4e35f207a2d783401e4920","observation_id":"880fe511-f59c-4986-bace-76c22b63dc09","resolution":{"observed_at":"2026-08-05T12:44:43.365779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-05T12:44:43.397239Z","title":"Palm: Scaling language modeling with pathways,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.397239Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:a9c57ee9a843eda10674612fd6920057ee53d85d1a6e4f0c951b7ece9b2cb4bd","observation_id":"5952b714-538c-462b-8f3c-8d3eb4fae4ee","resolution":{"observed_at":"2026-08-05T12:44:43.397239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T12:44:43.458143Z","title":"Llama: Open and efficient founda- tion language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.458143Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:f4a1cbec13b543172a08a2d17605eb48e3faf1a400f21537de9e9101cf7f516b","observation_id":"7dfe23a3-ca38-4cfb-8bec-beecad2de322","resolution":{"observed_at":"2026-08-05T12:44:43.458143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T12:44:43.561992Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.561992Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:96c17451be2b5bf11bfb0b3e79dbcb8a712f5680191493b5a93b9ebb9efa9710","observation_id":"7a24f0f9-8d01-4a98-b6d0-332ecb44359e","resolution":{"observed_at":"2026-08-05T12:44:43.561992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-05T12:44:43.640545Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.640545Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:98f3332fc6bd876593744eaeba074cc56c732786277eeb3179d1be75c4fb936c","observation_id":"56985dd0-76ec-4d9d-994e-99a6486f3d71","resolution":{"observed_at":"2026-08-05T12:44:43.640545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14238","last_updated":"2024-01-15T15:23:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-21T18:59:31Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14238","snapshot_observed_at":"2026-08-05T12:44:43.720036Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.720036Z"},"links":{"cited_paper":"/paper/2312.14238","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:55c45bcc99a122446d512ce73f3e15b954311f9c67b4e367c3ffd3471a79ba92","observation_id":"de09c3ad-7eda-4d7b-a562-b65590640e74","resolution":{"observed_at":"2026-08-05T12:44:43.720036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-08-21T07:48:51.700518Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-05T12:44:43.811070Z","title":"Minicpm-v: A gpt-4v level mllm on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.811070Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:2cc4a6de5d04c4914b277afaa7d77207889bd60e2e533128b2d20f440f674dbc","observation_id":"8a048d35-ada0-40b1-afb1-687c0dbf2dd4","resolution":{"observed_at":"2026-08-05T12:44:43.811070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T12:44:43.921351Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.921351Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:e532e55e8c8387cfdcd45e16a486f8767546d2db4c3e10c46e84abb03e90bb06","observation_id":"1156148b-7d61-4250-873f-b0c32602c1a8","resolution":{"observed_at":"2026-08-05T12:44:43.921351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T12:44:43.967690Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:43.967690Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:4bf1feffb1f2811ff1d546d8f9e492710467a72a6ab16f3ed9d73287bd50272e","observation_id":"e9c480e1-b2bd-4b84-a56a-c61e657f4c70","resolution":{"observed_at":"2026-08-05T12:44:43.967690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:54.966651Z","title":"Show 11 and tell: A neural image caption generator,","venue":null,"work_id":"f5932706-e6d6-4931-8306-8c4f46ce5b85","year":2015},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.022186Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:61f1b06d1a33ba580df589bdb50e82f5f896b83df6406b007da3559a9335e9aa","observation_id":"8712c688-fe18-4866-a5a4-634a10446085","resolution":{"observed_at":"2026-08-05T12:44:55.022694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:54.823604Z","title":"Deep visual-semantic align- ments for generating image descriptions,","venue":null,"work_id":"f7144c61-eeef-489b-af09-5d9f69350d08","year":2015},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.099409Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ca4f837e98360551d606a7979852cc7a4785b591506f62461499ad609be5c879","observation_id":"aecaac5b-7311-4b92-83d1-e3c47b25eb28","resolution":{"observed_at":"2026-08-05T12:44:54.903233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:54.692965Z","title":"Vqa: Visual question answering,","venue":null,"work_id":"2425489b-4bbc-4b96-97df-f8cd0811970e","year":2015},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.178128Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:0a674bf29788397fe08efe61167b575e7867a6c9e25a09103aa725fe42845d7e","observation_id":"1919ff89-0298-4741-bb0a-01b5ab71554e","resolution":{"observed_at":"2026-08-05T12:44:54.764109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05612","last_updated":"2018-07-29T19:11:57Z","snapshot_observed_at":"2026-08-14T20:46:56.185352Z","submitted_at":"2017-07-18T13:51:32Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.05612","snapshot_observed_at":"2026-08-05T12:44:44.266231Z","title":"Vse++: Improving visual-semantic embeddings with hard nega- tives,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.266231Z"},"links":{"cited_paper":"/paper/1707.05612","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:b232e2964b68d55e45eb1c70c62e8b2f48212e9f9c8ed44a5167f60a801d2a2f","observation_id":"5a9f3fb1-e305-4d88-99e3-e2b7ceca5c3c","resolution":{"observed_at":"2026-08-05T12:44:44.266231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:54.533166Z","title":"Vilbert: Pre- training task-agnostic visiolinguistic representations for vision-and-language tasks,","venue":null,"work_id":"ad3a63fb-0590-433e-8856-44ea353c5de9","year":2019},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.317093Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:f711063823d073c1d5ab567ba265e2ae0d78df284b6571472dd1aad0a9ee34fe","observation_id":"f7b583ba-5e7b-4b2b-a552-8b035e747516","resolution":{"observed_at":"2026-08-05T12:44:54.632746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:54.286455Z","title":"Img2loc: Revisiting image geolocaliza- tion using multi-modality foundation models and image- based retrieval-augmented generation,","venue":null,"work_id":"65829cbf-33c5-40a6-a733-4706c7ce9f6e","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.365095Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:50242091695b041ac53349fd68ceefe08add170f358672dcd0989c2bc0d3ee87","observation_id":"f8e989bc-bb5c-409d-9c7e-74c6df9fbc68","resolution":{"observed_at":"2026-08-05T12:44:54.398137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:54.023520Z","title":"Large-scale image geolocal- ization,","venue":null,"work_id":"b78bc3f5-255e-484d-ac8e-b1462e29861c","year":2015},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.452782Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:a1bfba0c1bfef5a5050b9fb130e55c3cd8dcba81d8370a0367764d0874b47c1e","observation_id":"93247d2b-4068-4797-a65f-f030b1440fa5","resolution":{"observed_at":"2026-08-05T12:44:54.136973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:53.746617Z","title":"What makes paris look like paris?","venue":null,"work_id":"6ed99b1a-181a-4396-845f-e832a1c3e044","year":2015},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.569135Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ecad71b522bfd542876f6dcd2cb0be8b7c349946dea439513fd4ff0b2d15d05d","observation_id":"8fdf0d41-304f-4887-ae07-8ccb283d5ad7","resolution":{"observed_at":"2026-08-05T12:44:53.914623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:53.541963Z","title":"Ge- olocation estimation of photos using a hierarchical model and scene classification,","venue":null,"work_id":"0b7bbbd2-a4e9-4767-a381-9750da3187d7","year":2018},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.628214Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:d2f2dbc03049f2e637d509cbf96afb41b3aad02cd7aafd981bf33e3ba1943d91","observation_id":"ec9d0991-4e47-4dd2-8ef8-afd231c9a84c","resolution":{"observed_at":"2026-08-05T12:44:53.666246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:53.367419Z","title":"Cplanet: Enhancing image geolocalization by combinatorial par- titioning of maps,","venue":null,"work_id":"3688f444-94fd-468a-bb08-b72badcdde5d","year":2018},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.703508Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:9ee0953b5b0b40a3ccf9d68805159e0c12dd91a796f108f21fb8caf50b55b84e","observation_id":"2c97a1c7-eadb-4ea7-9a86-3a98694af1f2","resolution":{"observed_at":"2026-08-05T12:44:53.458383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:53.212976Z","title":"Where in the world is this image? transformer-based geo-localization in the wild,","venue":null,"work_id":"bf332bbf-06c9-4766-bc6a-fad7b9c594de","year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.778255Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:03df5e7f2f63eca77f7ed590c5dbc2da960753a59720bb6cd9abc1ff5ee1b964","observation_id":"390b479b-8aca-4e18-8c60-f7c1dfd23d13","resolution":{"observed_at":"2026-08-05T12:44:53.316493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:53.042870Z","title":"Where we are and what we’re looking at: Query based worldwide image geo-localization using hierarchies and scenes,","venue":null,"work_id":"d7c2e7ca-ccb7-40d3-a81f-8a688d22b545","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.833945Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:f93526671f8c9344347487dc2d2682eeaca3f259f9530dd94bb588de1dd4aaed","observation_id":"11958203-564f-4fc1-8d4b-45a08ff3e5b8","resolution":{"observed_at":"2026-08-05T12:44:53.130919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:52.882489Z","title":"Transgeo: Transformer is all you need for cross-view image geo-localization,","venue":null,"work_id":"da13b5d3-7b22-49d1-9d26-276fb282f496","year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.909485Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:1075a80192600a38585578c196e7a3508925150168bd3dea9ada4de2cec8cfe1","observation_id":"aa5af6f2-8168-400d-9857-daf113528395","resolution":{"observed_at":"2026-08-05T12:44:52.962477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:52.731520Z","title":"Joint representation learning and keypoint detection for cross-view geo-localization,","venue":null,"work_id":"2403f333-91f4-4f9e-b8d5-e99b9b70c589","year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.934565Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:2fc2e06dd242345889ecd3ed9dd3f4315fbef44b2380441bf03a10f897771c87","observation_id":"d7573abb-40f9-48b6-b838-05d718823ca5","resolution":{"observed_at":"2026-08-05T12:44:52.830862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:52.578529Z","title":"Cross-view geo-localization via learning disentangled geometric layout correspondence,","venue":null,"work_id":"ee202378-f45e-4026-8b88-6345248bdfdc","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:44.984337Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:cefe564d0612ccfc15dd719cbceaef61b8f9827119d3cc3fb6f426b8512cbd63","observation_id":"bdeecf7a-b745-4f32-b58b-6bac9ee8931b","resolution":{"observed_at":"2026-08-05T12:44:52.674128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:52.467774Z","title":"The benchmarking initiative for multimedia evaluation: Mediaeval 2016,","venue":null,"work_id":"a0700fe2-2db8-4e33-8213-936c756ac795","year":2016},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.045779Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:65f42b9c728b3495e272d4ded7dff80aefdd040f6d7f8bc6dc0f4a6606cc5a9c","observation_id":"bf70c786-b281-4264-959d-8b9a991d6abd","resolution":{"observed_at":"2026-08-05T12:44:52.524673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:52.326955Z","title":"Inter- pretable semantic photo geolocation,","venue":null,"work_id":"a3121676-4b76-444e-91d8-df924e797391","year":2022},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.115249Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:a0c44a1db958d931d531938b95a437fc3232e280fbe1e594a2edc60fc827bd53","observation_id":"f1089739-13c9-429e-b772-dbdf4d26438f","resolution":{"observed_at":"2026-08-05T12:44:52.385187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:45.180435Z","title":"The faiss library,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.180435Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:a1390151a8a9114c7fa5fed408396e3c497fcde879bb8ca9f2c39034cd13efae","observation_id":"9c300b8b-4080-48a5-a405-fab3e6ac5a58","resolution":{"observed_at":"2026-08-05T12:44:45.180435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:52.182300Z","title":"Billion-scale similarity search with gpus,","venue":null,"work_id":"b731782b-6487-4188-ae6a-2c4e68bac3e0","year":2019},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.306594Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:9ea9a38276dbdd2e7f7ebe4c5f2178ec99a4bad73eb6cb231ea54f02597da9ff","observation_id":"6b59d702-478d-4748-9765-736baf23ce6f","resolution":{"observed_at":"2026-08-05T12:44:52.215129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:52.016978Z","title":"Yfcc100m: The new data in multimedia research,","venue":null,"work_id":"4cd06956-191b-4eaf-a577-fc31f5592957","year":2016},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.374822Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:92a98bcc6e39d1aadc9d4766d72750990ecaafb99122ba1b6d554207faa9974a","observation_id":"d07ba2f8-7eb1-4b40-bef2-faa9cf972975","resolution":{"observed_at":"2026-08-05T12:44:52.074636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:51.918535Z","title":"Geopositioning accuracy assess- ment of geoeye-1 panchromatic and multispectral im- agery,","venue":null,"work_id":"a3c0aff6-e7e1-4d67-ba07-1fa5b6c521b2","year":2012},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.489852Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:4f48d6c99eba38e8631fb7ea5e7a9cbb23261bd0d5d2c2ad81791f333f485725","observation_id":"959b2052-497d-4fcd-bcb4-4a0ffbe65d30","resolution":{"observed_at":"2026-08-05T12:44:51.957721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:51.697804Z","title":"Autonomous smartphone-based wifi positioning system by using access points localization and crowdsourcing,","venue":null,"work_id":"4e3d9746-7fdd-4fef-9ba0-ff47e43065be","year":2015},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.575701Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:419731a1c27a403f17f9bda80ba2a60530848edc13b9eff22f8ca1862b06315e","observation_id":"e993cba4-d829-4ba5-a004-f6081c766d98","resolution":{"observed_at":"2026-08-05T12:44:51.803318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:51.545579Z","title":"A faster and more effective cross-view matching method of uav and satellite images for uav geolocalization,","venue":null,"work_id":"5f5fe57b-e1b9-4604-8d03-aee4c9a1d3f5","year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.649573Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:9b992d1193c9763789a60f3ee6fccd9178aa1388d94e405e31e963c4820aee11","observation_id":"61f78d01-b827-4d49-9096-c970a99a6bb6","resolution":{"observed_at":"2026-08-05T12:44:51.613103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:51.402396Z","title":"Efficient localisation using images and open- streetmaps,","venue":null,"work_id":"e7acab5d-011f-42f3-91fb-5dd100e80999","year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.764378Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:df6cd3ae1c0ac53adc0a710a5fb4187e2bb72b2b9d4f60f7c4bc4795da145a2e","observation_id":"8aeead03-afc3-4fad-baf3-d540f0bf5a74","resolution":{"observed_at":"2026-08-05T12:44:51.440018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:51.227882Z","title":"Automatic discovery and geotagging of objects from street view imagery,","venue":null,"work_id":"757f7e75-b32e-4a73-b54f-6d25a9734742","year":2018},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:45.894119Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:5674c4a7ca0a673b141bd60fe90ef4d02f4e19d13d536ee412fd79b18a90e4e6","observation_id":"4f5cec11-b144-453e-b553-abd7e0dd097c","resolution":{"observed_at":"2026-08-05T12:44:51.294148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:51.048550Z","title":"Swin transformer: Hierarchical vi- sion transformer using shifted windows,","venue":null,"work_id":"fcbfc5ae-6941-4a74-9673-53b20238f595","year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.013528Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:2908c7f67baa58290c2b9fcff178e18945ea9205936b229561a5529b711bc1ad","observation_id":"c3a3bb35-a88f-4089-a5e0-90f4563999ed","resolution":{"observed_at":"2026-08-05T12:44:51.109136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:50.871050Z","title":"Pigeon: Predicting image geolocations,","venue":null,"work_id":"d6e979e0-5ee1-45fe-9482-ab64348afbbf","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.092102Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:f030e21e49ad99533efb2bdf5ee3b6a4b24031aed496e77cbdc12c4fdc9e8d8a","observation_id":"6263de81-4f9a-4ef4-ba6f-e56112e6c771","resolution":{"observed_at":"2026-08-05T12:44:50.940559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:50.773619Z","title":"Geoclip: Clip-inspired alignment between locations and images for effective worldwide geo-localization,","venue":null,"work_id":"30b41283-3cde-4b1e-929c-665dc38af8d8","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.211759Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:551ed3d18e9c3d3c86d952ff46d1e33e4d70888e98db936e934b5e4ce3dcabc2","observation_id":"d03ea6a7-3a1a-4523-849d-a31a1b2b85e6","resolution":{"observed_at":"2026-08-05T12:44:50.819586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:46.309752Z","title":"Openclip,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.309752Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:d61b245b1be403f896d387b99af25b331c1f7cf4c0edecc5d8dfa553daf66aa6","observation_id":"f7239308-2b12-4de0-a9a4-ed0315e71564","resolution":{"observed_at":"2026-08-05T12:44:46.309752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:50.609919Z","title":"Learning generalized zero-shot learners for open-domain image geolocaliza- tion,","venue":null,"work_id":"0236de24-ad20-4c73-b6c2-134b1b1889e1","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.413062Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:3adb1e7633326c2f0a9b99998075c35d716f2ec3900d74ea2f665dc308e38ebc","observation_id":"dc2a882b-f5af-4897-8be7-d3fe031030d6","resolution":{"observed_at":"2026-08-05T12:44:50.702106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T12:44:46.492478Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.492478Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:8f8e10c2bac805d1658504d11bddd24645c36b413edc0b151bc95d9abcb22b92","observation_id":"dcbbb522-3ff9-461f-ba18-988243d79354","resolution":{"observed_at":"2026-08-05T12:44:46.492478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-08-17T14:16:52.244007Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-05T12:44:46.547977Z","title":"How far are we to gpt-4v? closing the gap to commercial multi- modal models with open-source suites,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.547977Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:d69486937ee10ae35a1e420e4a3ebfda1b3560d7da298362ec12d6d345910185","observation_id":"1da6a83b-226e-4666-88dc-2d8016bebf4a","resolution":{"observed_at":"2026-08-05T12:44:46.547977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-08-05T12:44:46.631322Z","title":"Pixtral 12b,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.631322Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:6d4806cac4c890093f1fa15c26ddfe51edacccf4fa6b97bf27ddade1e2f5b9bc","observation_id":"f76c6ad0-07e8-41bb-8f08-e68aeee0b328","resolution":{"observed_at":"2026-08-05T12:44:46.631322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05993","last_updated":"2025-01-10T08:35:13Z","snapshot_observed_at":"2026-08-16T13:11:31.171443Z","submitted_at":"2024-10-08T12:44:57Z","title":"Aria: An Open Multimodal Native Mixture-of-Experts Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05993","snapshot_observed_at":"2026-08-05T12:44:46.702453Z","title":"Aria: An open multimodal native mixture-of-experts model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.702453Z"},"links":{"cited_paper":"/paper/2410.05993","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:377e7d1a5e232257e2abb5cfee2623b88b33afcd2ddf1f838daed048ca484740","observation_id":"748abe4c-ecc3-4ce2-9b2c-bce63cc6da9b","resolution":{"observed_at":"2026-08-05T12:44:46.702453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:50.483997Z","title":"Hugging Face,","venue":null,"work_id":"4da57710-b899-4014-b527-231e433ca8ea","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.773560Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:feeffe6ee9ab0ad9a887c4857bf8c07b13615a05a368444bb84a0e965d8e97f1","observation_id":"d7bc1fa8-78b5-4306-97a3-7c91d1fc4885","resolution":{"observed_at":"2026-08-05T12:44:50.551802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-16T13:23:12.570742Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-05T12:44:46.842259Z","title":"A survey on evaluation of multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.842259Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:373523314a51db38949dfbd7c9c2dca71065f02ec5d7ac07b4832c7082db60d2","observation_id":"6d1b235c-0761-47ee-8af3-9719f156e79b","resolution":{"observed_at":"2026-08-05T12:44:46.842259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:50.340792Z","title":"M3exam: A multilingual, multimodal, multilevel bench- mark for examining large language models,","venue":null,"work_id":"8d2047ac-8f9c-4dfc-8b1e-c04127a6c066","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:46.926992Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:884278565338a716ecd48a59787368b5889ebe492d2c32c4dad52779668ac49e","observation_id":"9f9b6e5e-2f7f-489f-be1b-af083429b68e","resolution":{"observed_at":"2026-08-05T12:44:50.430619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:50.223314Z","title":"Lvlm-ehub: A comprehensive evaluation benchmark for large vision- language models,","venue":null,"work_id":"9aab671e-7293-451a-b237-36a23c9aeebe","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.011481Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:0ea999d6acdc0450316665a23bb6642e5329d5bc80cb157970128199e72a5e8a","observation_id":"a9fe15fb-3c3f-4370-9789-cd2c7f631c8e","resolution":{"observed_at":"2026-08-05T12:44:50.276940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:50.042495Z","title":"Seed-bench: Benchmarking multimodal large language models,","venue":null,"work_id":"d312d648-9395-44c6-ab60-18ee7f448ede","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.090861Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:01ab129f514c36ca01cab19140ddd9cb6be14c2ce4fd4e5162fd136ba32fa3b7","observation_id":"d7caa79b-4a75-4fcf-83cd-f4e60c6b36c5","resolution":{"observed_at":"2026-08-05T12:44:50.105747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-05T12:44:47.141517Z","title":"Awq: Activation-aware weight quantization for llm compression and acceleration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.141517Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ea7c1ff262cee4ff7b1afa43305579ad9755a04cfe06edd35ad874c417a0240e","observation_id":"67d6ef8a-69c1-45b1-bcef-c86b5667d0fa","resolution":{"observed_at":"2026-08-05T12:44:47.141517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T12:44:47.201600Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.201600Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:6201c7730bcbe33d63166559db46c77014d2e85070b7bbbf7dc3c723bfdf189c","observation_id":"c42a2240-f37c-4717-9db7-cab6652f3bba","resolution":{"observed_at":"2026-08-05T12:44:47.201600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-05T12:44:47.296569Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.296569Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ebb33a9c0544a406fd4f6fbd83ac321db3bfdd6d7f200465f736b8d783aa4dbc","observation_id":"8e712d0c-016b-4fd6-97d5-71b4cbd335f7","resolution":{"observed_at":"2026-08-05T12:44:47.296569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.13935429","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"python-pillow/pillow: 11.0.0,","venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"f0ea62cf-6da6-41da-b24a-335e24e41dab","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.383043Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:975539b42199c22360116e83a5b0bc5e93f837033506007cfe8d655d87651098","observation_id":"1098a94b-6014-4063-af94-7e7fcfeb2975","resolution":{"observed_at":"2026-08-05T12:44:48.175217Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-05T12:44:47.435962Z","title":"Huggingface’s transformers: State-of-the-art natural language processing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.435962Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:4ba38aac7c3993f11ec3917da8e9dbabe86ebe384d158e00476166526cdd1a66","observation_id":"751105cc-5dd3-4d25-bef7-a8c1233ea7bd","resolution":{"observed_at":"2026-08-05T12:44:47.435962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:47.493064Z","title":"pandas-dev/pandas: Pandas,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.493064Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:671238183b72614c0a980135bb49dda89052011606de1e8b0d0c91c5429b7ca5","observation_id":"f3dcd693-9f4b-47d5-b47b-663877724f4a","resolution":{"observed_at":"2026-08-05T12:44:47.493064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:49.866642Z","title":"Efficient memory management for large language model serv- ing with pagedattention,","venue":null,"work_id":"c1c8fec8-a370-4d7c-93af-7231fd10e006","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.569033Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:15e0632d8147cd280a265a0f8bcca98069c7a54be064fa4522b9353caea3cfbc","observation_id":"85369fd2-16fa-4b1e-92bc-c239d42da949","resolution":{"observed_at":"2026-08-05T12:44:49.914094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:49.657314Z","title":"Lmdeploy: A toolkit for compress- ing, deploying, and serving llm,","venue":null,"work_id":"b2e01d02-c397-4732-afc3-b5f973810d7a","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.669560Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:e306766f4cc0a54c88dd99f778996bfb620040944a0b20c821d555764a914931","observation_id":"0eedb2b4-04ce-4b73-b53b-a79dbc5d5de8","resolution":{"observed_at":"2026-08-05T12:44:49.714858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:49.452711Z","title":"Openai api reference - create chat com- pletion,","venue":null,"work_id":"71429ce0-4ee7-4857-b378-b1a7ae8fb084","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.765929Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:cfed9cbc4ec97c1ea6683745a53859e3c058caf65a187567d21030a9cafff47e","observation_id":"f9858eb9-10ad-4877-8281-99f34e16d669","resolution":{"observed_at":"2026-08-05T12:44:49.504315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:49.338602Z","title":"Api documentation - sampling parameters,","venue":null,"work_id":"b64bccd0-7fe2-41b8-ba80-ee8b60727883","year":2024},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.844019Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:0f6f54f510753c0965a46d256b92ff0bd6b28cc28bdeed2b08601bb83aa0a61b","observation_id":"311f3814-ee22-4dbb-88d1-794690adb77f","resolution":{"observed_at":"2026-08-05T12:44:49.383932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:49.221094Z","title":"Geopy - geocoding library for python,","venue":null,"work_id":"1f167b91-e48e-4eb6-8f77-45e02d06569a","year":2014},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.908803Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:d7724d4ec775e8735ff5463f2a61ffa1b04bfd843e9fdac60ae3114137bc56a2","observation_id":"5038e851-277a-448e-9b02-124b67325bd8","resolution":{"observed_at":"2026-08-05T12:44:49.263319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:48.943223Z","title":"Georeasoner: Geo-localization with reasoning in street views using a large vision-language model,","venue":null,"work_id":"5fb557b5-6360-4b30-a4f2-2456c33e26ed","year":null},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:47.968111Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:ad660682ef384fe6e2fa04d5b34631eb31d3794960982669598788790a8eec9a","observation_id":"8b4b807c-fa9b-4e93-acda-433c080f0f2a","resolution":{"observed_at":"2026-08-05T12:44:49.086279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:48.800729Z","title":"Mixed land use measurement and mapping with street view images and spatial context-aware prompts via zero-shot multi- modal learning,","venue":null,"work_id":"5f7575e8-dd00-45ef-9856-d7ccaad3865f","year":2023},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:48.021916Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:20a32a9d03c3b323659908916a98085b985468c77c08cdf1ba4ebbfb78db1278","observation_id":"caab90b3-e5d4-4210-b7f7-ae246b814f48","resolution":{"observed_at":"2026-08-05T12:44:48.834967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:41.556636Z","title":"Available: https://www.sciencedirect","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:41.556636Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:8f2024f616177242b225095d2e8207237ed2d0900c1050512ea1c34ff53102b8","observation_id":"d71bd453-1c6a-473e-a8bb-beba2eeef0d7","resolution":{"observed_at":"2026-08-05T12:44:41.556636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:44:42.417808Z","title":"Available: http://dx.doi.org/10.1093/nsr/ nwae403","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T12:44:42.417808Z"},"links":{"citing_paper":"/paper/2509.01341"},"observation_digest":"sha256:b74b89afdd87cb22b2f6c4f98a5912a843596fb853738c6848ed746fbe4ad1ea","observation_id":"b35bafec-c252-40b3-80dc-c3cb4e79a603","resolution":{"observed_at":"2026-08-05T12:44:42.417808Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.01341","last_updated":"2025-09-01T10:23:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T00:47:12.431886Z","submitted_at":"2025-09-01T10:23:48Z","title":"Street-Level Geolocalization Using Multimodal Large Language Models and Retrieval-Augmented Generation"},"reference_resolution":{"displayed":93,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":2,"verified_fuzzy":47},"total_outbound_references":93},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 93 of 93 outbound references and 1 inbound Pith citation observation for arXiv:2509.01341."}