{"as_of":"2026-08-07T14:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9de4380a87e24bad69b6b8c8d962e2b3f446ed7a3b85fa88a0a7c515530d7698","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:59:58.397834Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.04107/citation-record","integrity":"/paper/2507.04107/integrity","json":"/paper/2507.04107/citation-record.json","paper":"/paper/2507.04107"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.236762Z","title":"Cross- view geo-localization via learning disentangled geometric layout correspondence","venue":null,"work_id":"bb8dedfd-bf76-42a1-adec-b2b72301377e","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.170788Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:45f9d16404d2fe8c724b6766eb236227a0c6097bc47c749c7ad0421ad1a6fa77","observation_id":"78d3db44-97ca-4a42-a1f0-3dda4a40c54d","resolution":{"observed_at":"2026-08-06T20:00:02.282733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.138315Z","title":"Geodtr+: Toward generic cross-view geolocalization via geometric disentan- glement.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46(12):10419–10433, 2024","venue":null,"work_id":"7bb2bb1c-8dcc-491b-b7c9-09b2ba7f711f","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.265962Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:49057f377ff0dd028323b675fd21f80784f13969f22d4cf3cb5ab086b2c91f36","observation_id":"cc0a21ac-81be-46bb-9afe-55a87596eb27","resolution":{"observed_at":"2026-08-06T20:00:02.188211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.040339Z","title":"Sample4geo: Hard negative sampling for cross-view geo-localisation, 2023","venue":null,"work_id":"c58f667c-8333-409d-83ab-457a79168f10","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.366124Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:d2a7d67665b00b8499d8dbdfacdf7f05819ac645b75094ef98eb96414f0416c0","observation_id":"51535e6a-28ab-4516-a5e4-9da5197844d4","resolution":{"observed_at":"2026-08-06T20:00:02.085988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.894114Z","title":null,"venue":null,"work_id":"f2854c82-4dab-4191-9e59-171278c569b6","year":2020},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.457914Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:03b5fd3fd938e5f7596cda1520092db69a20eeb90dd9d613c07605854aeb9fcb","observation_id":"361e91e4-cfe7-45d2-a9b6-d504d1ebfd6a","resolution":{"observed_at":"2026-08-06T20:00:01.961848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.798180Z","title":"Simple, effective and general: A new backbone for cross-view image geo-localization, 2023","venue":null,"work_id":"7edd2587-0ad8-4084-8be6-75372e275042","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.567986Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:089b60f9c2cbe8a5dc5029b7066a8c2d5e58df325866b2768b8955b8d8f6bf2e","observation_id":"08c2283b-36de-49ba-9179-1720f3eeb2da","resolution":{"observed_at":"2026-08-06T20:00:01.845653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.679407Z","title":"Cross-view image sequence geo-localization","venue":null,"work_id":"218df7c4-8833-470a-9e16-a2246d505a7c","year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.662245Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:cd4084896de363b4d5b7e2cd09867f2fd48feca1d258006dd2fef4ed4ac3e934","observation_id":"15c5e641-33ff-40a3-923b-a7725dab6186","resolution":{"observed_at":"2026-08-06T20:00:01.739880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.565746Z","title":"Image and object geo-localization.International Journal of Computer Vision, 132(4):1350– 1392, 2024","venue":null,"work_id":"c20d54e1-5cf1-4b7c-9f10-8530db0abc11","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.732852Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:eb275aae003f7a46b305de57d89463cb63287816272e13854e7fb78ed6d2a91f","observation_id":"64749e2a-c4be-4d07-beb1-8d7ccdc0439c","resolution":{"observed_at":"2026-08-06T20:00:01.601861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.464495Z","title":"Congeo: Robust cross-view geo-localization across ground view variations","venue":null,"work_id":"821a707d-dde4-4b11-9ff5-47b4f1cea589","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.814147Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:2ce1ad8810e8989fc64c16f207c519c71257f6f966e9360a269afd2011c05ca6","observation_id":"e214fb86-14c0-4985-b373-a48b0b33222c","resolution":{"observed_at":"2026-08-06T20:00:01.521389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.341650Z","title":"Where am i looking at? joint location and orientation estimation by cross-view matching","venue":null,"work_id":"55c7496e-c77d-4334-b29b-6dc51ee31c38","year":2020},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.900623Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:f76e5431d0636ec70bb2f94ec269bbba9ccb2ba9f94d88b3eb64abb99a051107","observation_id":"b143a93e-034e-4227-81d5-b048bed5413c","resolution":{"observed_at":"2026-08-06T20:00:01.401813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.260919Z","title":"ChatGPT (july 5 version)","venue":null,"work_id":"ffd19981-1f26-4d4b-9eca-1886ad17801e","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:55.991079Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:95ef1d40b7c12ffb2d3770429898c6f260e2fd2bd7d1e64812d4cd16459082a5","observation_id":"0dd338d3-d795-4666-91e6-8f095baa6b9f","resolution":{"observed_at":"2026-08-06T20:00:01.304730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T19:59:56.090989Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.090989Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:8e5ff885483402e3eb5f67f9f78ca12a4339a66f300dce74a5db94bb25ed8ebd","observation_id":"8b730e93-6573-4d0f-bb63-d9289990f747","resolution":{"observed_at":"2026-08-06T19:59:56.090989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T19:59:56.185649Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.185649Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:f6234e6f7ea2ad622e5123c9fa33996613873a3e81dc9476b821e95b932a61f1","observation_id":"5e90a634-5ac6-45c5-bcd8-60a795198268","resolution":{"observed_at":"2026-08-06T19:59:56.185649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:56.285551Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.285551Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:bced2aa5dd5e5fe51d2f182331534bd4fac4643262fef56c4976237aa9c569a4","observation_id":"95c3f64f-b752-492e-9237-71b047f20534","resolution":{"observed_at":"2026-08-06T19:59:56.285551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.112445Z","title":"Bliva: A simple multimodal llm for better handling of text-rich visual questions","venue":null,"work_id":"e641e600-4f5e-4f5f-82a2-33e4347c37fb","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.375098Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:fc81b51ea5f7c034db3b7609fb14b6dd2d93970f7e63d59c579a8f7cce7cb1de","observation_id":"67a06082-dd56-4bd1-a519-07a2b9552059","resolution":{"observed_at":"2026-08-06T20:00:01.179598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:56.478898Z","title":"Visual autoregressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.478898Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:4de33d13c0de0b07be08d9110fbde2ec521ba7b67632f07672027705df22c331","observation_id":"268beff7-fb3d-47f0-a2c5-424e88e6ea37","resolution":{"observed_at":"2026-08-06T19:59:56.478898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:01.024317Z","title":"On the location dependence of convolutional neural network features","venue":null,"work_id":"181f5dfe-8449-464f-99fe-8ca5879c37ef","year":2015},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.584382Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:3e807b2fbcf3f138399ee6969a9993f91b462e9e647409313bcb4ea82a76fcc8","observation_id":"6296c40b-d18d-4f95-a8d7-d23286ddb2a6","resolution":{"observed_at":"2026-08-06T20:00:01.060929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.871926Z","title":"Wide-area image geolo- calization with aerial reference imagery","venue":null,"work_id":"e7f3f652-2e92-464b-a494-154ca29b2eba","year":2015},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.684377Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:83edeb147af1992cf85f8a25ef9b662ec45233deec2b6f1af680ef4ec7a5cf8c","observation_id":"2568873d-c0b2-4bce-af41-aee88d5decbf","resolution":{"observed_at":"2026-08-06T20:00:00.944050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.690433Z","title":"Lending orientation to neural networks for cross-view geo-localization","venue":null,"work_id":"e4ab63f0-8acf-4349-b250-ef21a8a7b809","year":2019},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.790502Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:9d90841b8df5905bf76831ac33ebeb9b4db9f2975ef5a8df89fa14af60f04863","observation_id":"964d0994-66d9-4fbf-a81a-aef3ffffb0a8","resolution":{"observed_at":"2026-08-06T20:00:00.781560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.502328Z","title":"Vigor: Cross-view image geo- localization beyond one-to-one retrieval","venue":null,"work_id":"85281de1-1e3c-4c5a-aab9-5f9c356c7395","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.854526Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:a0b61220b39c5d35c930e35a4939d289198167a0781beb0c04554e7dd55e73a8","observation_id":"1e53de9a-74e4-49f3-85b8-755e36f55040","resolution":{"observed_at":"2026-08-06T20:00:00.593733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.388206Z","title":"Spagbol: Spatial-graph-based orientated localisation","venue":null,"work_id":"052a7bbe-dae1-4a78-b716-0a507470ae7c","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:56.971164Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:1f2236cf0b7eb923a8da1914e76638f5e415b48f9510ef42099feb78c99c6604","observation_id":"208ed397-bad6-4a5c-942c-191a7004b300","resolution":{"observed_at":"2026-08-06T20:00:00.445431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.215505Z","title":"Peng: Pose-enhanced geo- localisation.IEEE Robotics and Automation Letters, 10(4):3835–3842, 2025","venue":null,"work_id":"8a881dd4-987f-482c-9010-4290f4cfc67c","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.054535Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:f6bc97669de36bdbc90250a0ce4f580000e7b5e0ba543378e8105bf395dddac0","observation_id":"1c714b9a-035b-496f-b641-407bfa26b0e9","resolution":{"observed_at":"2026-08-06T20:00:00.295591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:00.032479Z","title":"Cv-cities: Ad- vancing cross-view geo-localization in global cities.IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing, 18:1592–1606, 2025","venue":null,"work_id":"334f4e30-b8a8-45e6-904c-8b64a427a7de","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.122545Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:705f4be4a5a2b6a71f8ad1043a1c689fe9b1aa556d85c5b471c91d53de66446f","observation_id":"aa69a88d-430e-4b7c-ac21-a09805f02dd6","resolution":{"observed_at":"2026-08-06T20:00:00.121176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:57.231091Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.231091Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:85e14aa4c08a851302ccd8c00669edf86e22026803231d5629568ea53518b5fb","observation_id":"ba34a03d-365a-46a3-9ec2-07fbc5e6df3d","resolution":{"observed_at":"2026-08-06T19:59:57.231091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.862184Z","title":null,"venue":null,"work_id":"7cb81dfa-39e9-4061-8d09-1dea89bd0605","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.328530Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:6665a0dcdacfe39d3c117bba003fa8d86e42fb7e29ea1c90bf1a97ec4e22d6ec","observation_id":"263785b6-2d95-49bd-abed-4f5e4520ee05","resolution":{"observed_at":"2026-08-06T19:59:59.935333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.704487Z","title":"Transgeo: Transformer is all you need for cross-view image geo-localization.2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 1152–1161, 2022","venue":null,"work_id":"ced298fb-181a-467a-a672-c313713b2947","year":2022},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.416773Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:fd6d8a99080e94473524ac2d846de868113d1afa06f6fc56ac132f87cd205a44","observation_id":"09edb0d9-aef4-48b1-9fbf-76083357cc32","resolution":{"observed_at":"2026-08-06T19:59:59.788307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.502850Z","title":"Georeasoner: Geo-localization with reasoning in street views using a large vision-language model","venue":null,"work_id":"52550d2b-1c8b-42b7-928a-cd00bd95a200","year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.519350Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:738a394a31cf697b7c2a8ecdee044abf95a3f698fd60839b339b9021fcdf346d","observation_id":"c6c453c7-b884-4586-aeb0-74aaff52b92a","resolution":{"observed_at":"2026-08-06T19:59:59.599049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17007","last_updated":"2025-04-01T02:48:45Z","snapshot_observed_at":"2026-08-05T15:59:34.691624Z","submitted_at":"2024-12-22T13:13:10Z","title":"Where am I? Cross-View Geo-localization with Natural Language Descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17007","snapshot_observed_at":"2026-08-06T19:59:57.592877Z","title":"Where am i? cross-view geo-localization with natural language descriptions.arXiv preprint arXiv:2412.17007, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.592877Z"},"links":{"cited_paper":"/paper/2412.17007","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:afb7163c7bfb14eb442730d41e0fc9f92ff21d18a4989e6e4aaecd7fbd61483a","observation_id":"cfae7852-d323-4a8b-a5a8-700d0e4b85e6","resolution":{"observed_at":"2026-08-06T19:59:57.592877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.326441Z","title":"Geovlm: Improving auto- mated vehicle geolocalisation using vision-language matching, 2025","venue":null,"work_id":"911d1b1c-a9bf-40b5-add0-cd17012f76cb","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.642433Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:3fa75f1fec4429e37e25c4f658a3bbb8c8e507212fcbfb133c000c926e96c9fb","observation_id":"fadb36bf-8e72-44e0-855a-acc0f2658900","resolution":{"observed_at":"2026-08-06T19:59:59.441361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:59.148935Z","title":"University-1652: A multi-view multi-source benchmark for drone-based geo-localization.ACM Multimedia, 2020","venue":null,"work_id":"e747bc2d-2c84-4202-9b0c-0ba89290a2e8","year":2020},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.714391Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:257899729034fca81b898599018a890bbdfc4a8b457d11ed8b9714d3b6b7ab98","observation_id":"c173afdc-5d5f-48d6-beab-948de82bc91d","resolution":{"observed_at":"2026-08-06T19:59:59.264201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:57.801432Z","title":"Pytorch: An imperative style, high-performance deep learning library.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.801432Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:4850f37f77b907bc84cc4d6c815421081a94fb072da0d266eecb860d195a599b","observation_id":"3b477a0d-92a7-4331-9d9b-57a3049401f0","resolution":{"observed_at":"2026-08-06T19:59:57.801432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T19:59:57.882093Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.882093Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:41c5d26b873a5fe822384b09c144793b2118fdeb06ecaa04090c715aa051e6cd","observation_id":"ff09ffc5-e158-420f-8e01-a88c9650c701","resolution":{"observed_at":"2026-08-06T19:59:57.882093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.994900Z","title":"A convnet for the 2020s","venue":null,"work_id":"c40a9ecd-8c97-46e3-b4c5-d7358c0c0fae","year":2022},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:57.950810Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:159e40300a149c76ad4306d6f6a52ab0921e96b76e94589ca539adbc1022efca","observation_id":"73ccb25b-20a6-471e-b241-f75b5abcdd48","resolution":{"observed_at":"2026-08-06T19:59:59.069807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.849213Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"08ce221f-b539-40fd-9ea6-031588b6513c","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.015952Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:7c3e4bbf21a6d64c80c4eaa70b53122c46f3bc5a924996fa5118c83948f4fc12","observation_id":"5d3ecda2-c1fc-4f6d-9486-5639d152c223","resolution":{"observed_at":"2026-08-06T19:59:58.918815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T19:59:58.117869Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.117869Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:05c89f8034f768b1894825b366f3d4632d782270989a354e3fb74cccdc90041e","observation_id":"9c6108aa-ef18-46e4-acc7-ea998b83655d","resolution":{"observed_at":"2026-08-06T19:59:58.117869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.671599Z","title":"Gemini 2.5 flash model","venue":null,"work_id":"6d36a4ef-df06-48aa-98c1-a2cc4de8804d","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.221790Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:db5dcea08ae465277a3c9501dcf492854b150539cb3260a42c47089de54416b0","observation_id":"37d4a756-5276-45ff-a840-7cda54c051af","resolution":{"observed_at":"2026-08-06T19:59:58.760454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:58.552399Z","title":"Each part matters: Local patterns facilitate cross-view geo- localization.IEEE Transactions on Circuits and Systems for Video Technology, 32(2):867–879, 2021","venue":null,"work_id":"7ba011bf-b0d9-4f36-888e-30bc003aa3ac","year":2021},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.292306Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:0cb74e879db69abe4c8e20851af7e614bdf787c40f882fb014cf1f27594c6aa5","observation_id":"d08068cb-dd39-491d-9b6a-b0d5d0a909cd","resolution":{"observed_at":"2026-08-06T19:59:58.577202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:00:02.350716Z","title":"The 3rd workshop on uavs in multime- dia: Capturing the world from a new perspective","venue":null,"work_id":"300686a1-33e8-48e7-9d8d-beaba7c16b49","year":2025},"citing_paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:58.397834Z"},"links":{"citing_paper":"/paper/2507.04107"},"observation_digest":"sha256:dc403a142103369a8cc4aa9b4580e6c203b1c8347e635e1aaa37f81d98173aa7","observation_id":"90fd5245-df34-4d0f-a600-484aec3b024b","resolution":{"observed_at":"2026-08-06T20:00:02.416141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04107","last_updated":"2025-07-22T17:13:07Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:52:56.182392Z","submitted_at":"2025-07-05T17:31:06Z","title":"VICI: VLM-Instructed Cross-view Image-localisation"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2507.04107."}