{"as_of":"2026-08-07T15:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3debe8b26dd14d4dc5aef3ba2608e366b1f1a4709ceaaba0fc13869aad166b4","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:23:03.854976Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T15:04:33.971109Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T15:06:17.957292Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2508.10667","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10667","snapshot_observed_at":"2026-07-09T15:06:17.957292Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","venue":"cs.CV","work_id":"e7286bb8-4957-489e-8a08-3c306fde5173","year":2025},"citing_paper":{"arxiv_id":"2607.07292","last_updated":"2026-07-08T11:33:35Z","snapshot_observed_at":"2026-07-11T23:19:05.013112Z","submitted_at":"2026-07-08T11:33:35Z","title":"CarbonCLIP: Enhance Carbon Prediction from Satellite Imagery via Integrated Street-View Semantics and Temporal Context Training","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-09T15:04:33.971109Z"},"links":{"cited_paper":"/paper/2508.10667","citing_paper":"/paper/2607.07292"},"observation_digest":"sha256:29216764c0e256f053c9e05b357737482e58b553c6076e0cd2572742ce5cef86","observation_id":"74bcbcc9-9dee-4d4f-a526-8484be4055ca","resolution":{"observed_at":"2026-07-09T15:06:17.958785Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.10667/citation-record","integrity":"/paper/2508.10667/integrity","json":"/paper/2508.10667/citation-record.json","paper":"/paper/2508.10667"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.280567Z","title":"In: CVPR, pp","venue":null,"work_id":"c323c512-9797-42f4-9136-942c82e06d9d","year":2016},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.705828Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:976c8229331748982fd9af57e4b178a8d484eee1775f61aea68064c943eba928","observation_id":"72987dc3-3af0-4a63-ac5d-630c7925a172","resolution":{"observed_at":"2026-08-05T20:23:04.284257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.269813Z","title":"In: CVPR, pp","venue":null,"work_id":"d339c358-25e4-465b-8310-e65dc9ad4590","year":2022},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.710640Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:3dd97c0e51cc7c6d971c938fe9078dc0138965c4de7e4d8115675c4a18a15ddc","observation_id":"d823f014-be65-4528-a500-87fbbc7bb3de","resolution":{"observed_at":"2026-08-05T20:23:04.273364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.258422Z","title":"In: W ACV, pp","venue":null,"work_id":"1105f721-3e1a-4b6a-9b4e-16c8acd32fc4","year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.714934Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:40d85d8b61ec889632436d0f7c19eb737b5893053d7f8dad37727bc392d03909","observation_id":"544fbd48-d857-4e6e-83d0-87eed354602d","resolution":{"observed_at":"2026-08-05T20:23:04.262897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.247128Z","title":"In: ECCV (2024)","venue":null,"work_id":"da87c2a4-810c-4034-994b-23b6299dc575","year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.720015Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:c22c1e14b1b637dae046ec2d4f62ca8993244f8cef25127c1f8c0b53161476a3","observation_id":"1487d1dc-3def-445e-8a68-8fc76ab93bfb","resolution":{"observed_at":"2026-08-05T20:23:04.250886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T20:23:03.724480Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.724480Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:5083a6d31bf5ce7aeba1f32c34ec8273ee46e07b44c695f5c60254782213184b","observation_id":"53877a04-b544-41c6-82d5-269657ae6492","resolution":{"observed_at":"2026-08-05T20:23:03.724480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.234347Z","title":null,"venue":null,"work_id":"2208d067-d803-434b-8e1d-cfb5d1c0f084","year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.729093Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:6ed784d38e224b62f789542fa3f3785ba7dd7e736d14a4b5032d45d2bb4c3bf9","observation_id":"78082124-ccf6-436e-99dd-0ffc220705f9","resolution":{"observed_at":"2026-08-05T20:23:04.239072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:03.732980Z","title":"In: NeurIPS (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.732980Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:c2452303a99ae2f227f64f15a08456b03d41c2576b206ac065a736614cb9f58b","observation_id":"30e8e6c0-4b1f-490b-97ab-dc30d4eec1f1","resolution":{"observed_at":"2026-08-05T20:23:03.732980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-05T20:23:03.736533Z","title":"arXiv preprint arXiv:2309.17421 9(1), 1 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.736533Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:6f7ed201cd870efbdb04b5f841365da48f6fc1d4d0f2152c54ff860f214776d3","observation_id":"8e3119a3-1309-473e-bd4d-34b1c8da08de","resolution":{"observed_at":"2026-08-05T20:23:03.736533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.216321Z","title":"In: ICML (2024)","venue":null,"work_id":"c599456f-216d-44b8-b8c9-f55d4168093e","year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.740933Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:80f37ca5c3f68a54f2e34a777619170b2fb15932713cc330cd375479f2118ec3","observation_id":"3abd44d8-51ff-4a49-86ad-b5514c36ba64","resolution":{"observed_at":"2026-08-05T20:23:04.219991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-05T20:23:03.745358Z","title":"arXiv preprint arXiv:2106.09685 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.745358Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:5e7566f9fad37b1c3d6517e3341c36bdcc1712e820ca8a84979d13ed43d0881d","observation_id":"1ff9a654-1af2-42f0-8235-9d2129f0d3ae","resolution":{"observed_at":"2026-08-05T20:23:03.745358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09722","last_updated":"2024-06-14T05:14:54Z","snapshot_observed_at":"2026-08-07T05:40:09.191349Z","submitted_at":"2024-06-14T05:14:54Z","title":"Cross-view geo-localization: a survey","version":1},"cited_work":{"arxiv_id":"2406.09722","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.09722","snapshot_observed_at":"2026-08-05T20:23:03.979005Z","title":"Cross-view geo-localization: a survey","venue":"cs.CV","work_id":"763471c0-340e-4fe0-89c2-5199d7f7dd1e","year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.750848Z"},"links":{"cited_paper":"/paper/2406.09722","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:ce2dbac3347a3d75fd0a32e36edfe280ec6421130112cdc11458ebf40255cbef","observation_id":"99b870ec-470c-43da-9ece-a38634cca209","resolution":{"observed_at":"2026-08-05T20:23:03.985039Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.205496Z","title":"In: CVPR, pp","venue":null,"work_id":"8b09091d-0dde-48d5-ac36-7369204e113b","year":2013},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.756214Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:bf947445b0d9e5804743f209406281e487a62346839bbbeaa4901df1eaeb3d08","observation_id":"1235bdb6-67b2-4f42-b3e0-7536fd4ab73c","resolution":{"observed_at":"2026-08-05T20:23:04.209207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.193328Z","title":"In: CVPR, pp","venue":null,"work_id":"3e2e69b8-32c5-4ce0-ae69-d84b71bf647c","year":2022},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.760389Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:c49a961cb1a312cb3261f6e083636a5aadecdfabf9b9c99386642a9ade9322fa","observation_id":"75b55c9a-b9cf-4c94-979a-bb4a7797f0fb","resolution":{"observed_at":"2026-08-05T20:23:04.198302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.182466Z","title":"Pattern Recognition 113, 107760 (2021)","venue":null,"work_id":"06d67060-b317-4c9b-8312-b2554b9853ed","year":2021},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.764173Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:8a61859b6f5ec8d9cab9d83969ee106950b3ee097e8ae1b1e9c7e7c3d141bc33","observation_id":"c94c611a-bafc-4d44-a548-8bbfdd62faf5","resolution":{"observed_at":"2026-08-05T20:23:04.186367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.171724Z","title":"In: CVPR, pp","venue":null,"work_id":"18d08c95-583d-4b29-bd0b-b358bc0c7799","year":2021},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.768146Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:36b8c4db9210141c3ad5b028e6418899651d5d5051e2530bd09ee1213d632608","observation_id":"84177ddc-8423-4413-ab9f-9c5b02706710","resolution":{"observed_at":"2026-08-05T20:23:04.175192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.161444Z","title":"IEEE Robotics and Automation Letters (2023)","venue":null,"work_id":"b8210be5-cb43-448c-afaa-0cc7c5539bc2","year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.772232Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:28731641c9436750251edbe34ce752ee8ff79c8dfbb7c978244ab962dca3d655","observation_id":"f6da1c2a-6a79-4652-9f2d-6f76be04d434","resolution":{"observed_at":"2026-08-05T20:23:04.164979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.151428Z","title":"In: ECCV, pp","venue":null,"work_id":"24c96bb8-2203-4d8b-a483-d6729bb69e89","year":2018},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.776046Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:ae767706f0176b573a720f84f8c73c47a4efe9e9ccb72e417382c06a42e3fe7b","observation_id":"87a2969c-f374-4b0a-be9c-3fcdc39e43b7","resolution":{"observed_at":"2026-08-05T20:23:04.154969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.140153Z","title":"In: ECCV, pp","venue":null,"work_id":"61dccbbb-0daa-4ae4-aa50-dea6ff87f72f","year":2022},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.779587Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:7afcdc44572cc23473e7ee68e0e95fdeb2c24ff158953b4a7274e95feaa9bcef","observation_id":"aeb8fe3e-544d-4ef8-b05f-aa61c024138f","resolution":{"observed_at":"2026-08-05T20:23:04.144083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.129633Z","title":"In: CVPR, pp","venue":null,"work_id":"7e11d2c8-6b39-4e62-b1fa-c32ef8c4fafb","year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.783146Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:28c7ccccf00ed0beb0b893eb6eaf34d0b6573f0c950574221204f30e41b5a2a8","observation_id":"362f5416-0617-466d-a3ec-5ae06d1c7ef8","resolution":{"observed_at":"2026-08-05T20:23:04.133131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.118558Z","title":"In: ICCV, pp","venue":null,"work_id":"5f0461b4-d1cb-4edd-b967-dcd72f622073","year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.787900Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:17876eecf73d120a6bf40d977d3eced15f1c4ab2250e3d17afc8548bfd704176","observation_id":"bda7e6c0-9de6-4b76-86e0-3e30636c4b84","resolution":{"observed_at":"2026-08-05T20:23:04.122230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.107524Z","title":"In: ICML, pp","venue":null,"work_id":"64029bf8-dbaf-41ac-8f60-0e6392a50c62","year":2021},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.791548Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:2fbd29b1a6c7c96470869f552db2739b472154815094030ec41ce6743bb8f298","observation_id":"23228e3e-2f95-4c22-8968-15c212131484","resolution":{"observed_at":"2026-08-05T20:23:04.111263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00275","last_updated":"2023-02-01T06:44:07Z","snapshot_observed_at":"2026-07-06T14:46:56.842264Z","submitted_at":"2023-02-01T06:44:07Z","title":"Learning Generalized Zero-Shot Learners for Open-Domain Image Geolocalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00275","snapshot_observed_at":"2026-08-05T20:23:03.795340Z","title":"arXiv preprint arXiv:2302.00275 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.795340Z"},"links":{"cited_paper":"/paper/2302.00275","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:7e0b557241127ac733955d434c5337ed488eff96526b5946491a1354955bd9fe","observation_id":"27fa82f8-ad44-4ad3-8639-c0f2773ed18d","resolution":{"observed_at":"2026-08-05T20:23:03.795340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16020","last_updated":"2023-11-21T23:23:08Z","snapshot_observed_at":"2026-07-06T16:24:38.375055Z","submitted_at":"2023-09-27T20:54:56Z","title":"GeoCLIP: Clip-Inspired Alignment between Locations and Images for Effective Worldwide Geo-localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16020","snapshot_observed_at":"2026-08-05T20:23:03.799568Z","title":"arXiv preprint arXiv:2309.16020 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.799568Z"},"links":{"cited_paper":"/paper/2309.16020","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:9581dda7bd92523a02286a6c8d578fbb36070e241908c6078cff44e1995ce70d","observation_id":"a794de20-732a-44cd-b37f-20b2ac4862b0","resolution":{"observed_at":"2026-08-05T20:23:03.799568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T20:23:03.803889Z","title":"arXiv preprint arXiv:2302.13971 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.803889Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:544382289362f26e1576608fafdb5cda63bf73d8f8d2854d47a4f0a071701dad","observation_id":"733d3826-c0d7-49d1-8eda-b0b18c8a3962","resolution":{"observed_at":"2026-08-05T20:23:03.803889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T20:23:03.808841Z","title":"arXiv preprint arXiv:2310.06825 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.808841Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:69758e4f4ff6277b42b415d969552c324bc322574d2c08a654d67ca81eacbbab","observation_id":"6e62bc7f-f11a-43ef-be6e-61ab47c61140","resolution":{"observed_at":"2026-08-05T20:23:03.808841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T20:23:03.812997Z","title":"arXiv preprint arXiv:2407.10671 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.812997Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:e61b4251edd68b7da0e5763deae2f04ac446f6e077195bd4e06c99bdb49a3d3a","observation_id":"78665fca-c277-4e9b-a71c-5f1f82be3979","resolution":{"observed_at":"2026-08-05T20:23:03.812997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-05T20:23:03.816932Z","title":"arXiv preprint arXiv:2404.14219 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.816932Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:0c9276a0739d700ead8b4ad2ebd247f9197029824b2c017f815cb2d8abc645fb","observation_id":"5cf6e297-e972-4fe2-9a79-ebe210c09840","resolution":{"observed_at":"2026-08-05T20:23:03.816932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T20:23:03.821062Z","title":"arXiv preprint arXiv:2312.11805 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.821062Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:d2c173aec10043519fbcd67b2700fa72bf02238cc2d8806f9aeda7492d373b14","observation_id":"45a18865-8c9c-4628-8d06-28a83c2a62da","resolution":{"observed_at":"2026-08-05T20:23:03.821062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.096521Z","title":"In: CVPR, pp","venue":null,"work_id":"e5df1e94-83b3-46fa-a28a-961597a58fcf","year":2021},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.824842Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:5b7aa783e73cff464899c2b1455dd03a492a01dc619dcd0f0688f7ce5a2bc3e6","observation_id":"662538d0-c690-48bd-bbfe-187e6527a95f","resolution":{"observed_at":"2026-08-05T20:23:04.100240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.084891Z","title":"PloS one 18(3), 0283672 (2023)","venue":null,"work_id":"9e98b16c-6f9a-479e-9399-0282afc66656","year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.828567Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:b250acf2fa4faa17b4847f043ba1eefdfe2048374a03866e37a5c13fb711a249","observation_id":"cc763fee-4742-4fb8-b1c7-34cc09fb627f","resolution":{"observed_at":"2026-08-05T20:23:04.089082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.071942Z","title":"IEEE Transactions on Circuits and Systems for Video Technology 32(2), 867–879 (2021)","venue":null,"work_id":"43756423-4b37-47be-80fa-0f9610b517ee","year":2021},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.832265Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:962b394e2ae221773aed9a942775751b82e5f92f41695e4a09adf2148f172e4a","observation_id":"e9bf21c3-a61a-4321-b0fb-4410847b436d","resolution":{"observed_at":"2026-08-05T20:23:04.076233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13965","last_updated":"2024-09-04T18:32:38Z","snapshot_observed_at":"2026-07-06T17:47:59.544888Z","submitted_at":"2024-03-20T20:37:13Z","title":"ConGeo: Robust Cross-view Geo-localization across Ground View Variations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13965","snapshot_observed_at":"2026-08-05T20:23:03.835638Z","title":"arXiv preprint arXiv:2403.13965 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.835638Z"},"links":{"cited_paper":"/paper/2403.13965","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:c7987264399415c5ee2306711b0fc15e91e9aa09702c2daab5b2728d37b4e679","observation_id":"fed20f38-b79c-4c77-b3b8-f2cacd02d4f2","resolution":{"observed_at":"2026-08-05T20:23:03.835638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16831","last_updated":"2025-01-22T08:45:56Z","snapshot_observed_at":"2026-07-06T17:50:13.914184Z","submitted_at":"2024-03-25T14:57:18Z","title":"UrbanVLP: Multi-Granularity Vision-Language Pretraining for Urban Socioeconomic Indicator Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16831","snapshot_observed_at":"2026-08-05T20:23:03.839280Z","title":"arXiv preprint arXiv:2403.16831 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.839280Z"},"links":{"cited_paper":"/paper/2403.16831","citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:c5f8b32d106f2a1c4bf3588660876dc6d01ba13293eed7b9bb4e4e655b150639","observation_id":"62fe3d9e-6caf-4541-a283-54a95ff8f6e1","resolution":{"observed_at":"2026-08-05T20:23:03.839280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.060210Z","title":"https:// github.com/InternLM/xtuner (2023)","venue":null,"work_id":"c1761515-1da7-4a92-a871-037ca5e9003e","year":2023},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.842943Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:4206e98eb7548149c3b9470722ff63e55c11025e8b01059ba7cce026d0f133e5","observation_id":"a485a92c-a80e-45b7-aa38-7f767ae11762","resolution":{"observed_at":"2026-08-05T20:23:04.064275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.047899Z","title":"In: CVPR, pp","venue":null,"work_id":"24c08149-2e3f-4d80-95a2-2252282eaaaa","year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.846856Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:548205c8ec9ac42ef1001a0ebc4825f6de19080db45093d648112d7b124bbfe6","observation_id":"7641f69e-bb22-4465-af7e-9fe3856cafda","resolution":{"observed_at":"2026-08-05T20:23:04.052858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.036733Z","title":null,"venue":null,"work_id":"351d72d3-ceb3-408f-b27f-0fd920fa0b36","year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.850944Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:0207890be25a169976da68f0a967fd1edeeb654d8f949f7167aee1983656cd72","observation_id":"ef8a09d7-74d8-4a22-8b9d-eaa8f1cde247","resolution":{"observed_at":"2026-08-05T20:23:04.040223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:04.024878Z","title":null,"venue":null,"work_id":"6315c27e-0d64-4ca2-9435-1da6b788094f","year":2024},"citing_paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:03.854976Z"},"links":{"citing_paper":"/paper/2508.10667"},"observation_digest":"sha256:2fcb6f2518c1f69946fba450c592d3b9fa8761c381f54064beb4086cc09e517d","observation_id":"d195a7dc-6154-49d8-8c70-31891a0a8179","resolution":{"observed_at":"2026-08-05T20:23:04.029016Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.10667","last_updated":"2025-08-14T14:06:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T20:23:02.382856Z","submitted_at":"2025-08-14T14:06:28Z","title":"AddressVLM: Cross-view Alignment Tuning for Image Address Localization using Large Vision-Language Models"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":1,"unresolved":15,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2508.10667."}