{"as_of":"2026-08-08T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7594b089710ddec51ae6ca8502086e2cccca8414895ed4845e114199a0d65f50","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:47:09.321775Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T04:54:11.970813Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T01:16:25.161857Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"cited_work":{"arxiv_id":"2510.13774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.13774","snapshot_observed_at":"2026-07-02T01:16:25.161857Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","venue":"cs.LG","work_id":"9b05a660-21fd-4b5e-8cb7-28de91a4c7bb","year":2025},"citing_paper":{"arxiv_id":"2606.01745","last_updated":"2026-06-01T06:08:04Z","snapshot_observed_at":"2026-08-01T09:39:24.341923Z","submitted_at":"2026-06-01T06:08:04Z","title":"Enhancing the Socioeconomic Understanding of Foundation Models with Urban Mobility","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-28T12:11:02.997277Z"},"links":{"cited_paper":"/paper/2510.13774","citing_paper":"/paper/2606.01745"},"observation_digest":"sha256:ed82956030254798b26737c7cbdf897260ce1e6ac4d1d42808b052c115648981","observation_id":"a7e87bb6-4303-4d32-8f08-32cf7bf56464","resolution":{"observed_at":"2026-07-02T01:16:25.163161Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13774","snapshot_observed_at":"2026-08-02T04:54:11.970813Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13558","last_updated":"2026-07-15T08:01:42Z","snapshot_observed_at":"2026-08-07T07:42:35.306230Z","submitted_at":"2026-07-15T08:01:42Z","title":"Multi-Agent Collaborative Reasoning with Tool-Augmented Evidence for Urban Region Profiling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T04:54:11.970813Z"},"links":{"cited_paper":"/paper/2510.13774","citing_paper":"/paper/2607.13558"},"observation_digest":"sha256:74ae3f724f1f30ba5f28ffce0c1eef6a1e6530e78bb55f4a8e58afb9721e6fe0","observation_id":"b5e6995e-94cc-4413-b25f-73d0871cb0ba","resolution":{"observed_at":"2026-08-02T04:54:11.970813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2510.13774/citation-record","integrity":"/paper/2510.13774/integrity","json":"/paper/2510.13774/citation-record.json","paper":"/paper/2510.13774"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.07207","last_updated":"2026-04-06T17:56:18Z","snapshot_observed_at":"2026-07-06T19:48:36.508447Z","submitted_at":"2024-11-11T18:32:44Z","title":"General Geospatial Inference with a Population Dynamics Foundation Model","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07207","snapshot_observed_at":"2026-08-04T09:47:00.219239Z","title":"General geospatial inference with a population dynamics foundation model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.219239Z"},"links":{"cited_paper":"/paper/2411.07207","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:e8ec7b275369d10084a5ddd8b5c38ed320e143ed1e413111576438e7fa3de221","observation_id":"d3f1e3e5-13ca-4f03-b23e-14a31f32cfd3","resolution":{"observed_at":"2026-08-04T09:47:00.219239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:00.306405Z","title":"Optuna: A next-generation hyperparameter optimization framework","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.306405Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:8fba078bb78429b31a3107af43c492229f9cef8b10b3794de1470ec400f55a7c","observation_id":"f337204f-6f9e-4be6-9c94-02586dded7d1","resolution":{"observed_at":"2026-08-04T09:47:00.306405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:00.388836Z","title":"Crime open database (code)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.388836Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:38a29470d69c9472718cd4c1b30f0bccc4259c2688cf5863994f9ac48fcb3596","observation_id":"298c9420-2bd4-415d-aa60-1caf46332d5b","resolution":{"observed_at":"2026-08-04T09:47:00.388836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:00.517738Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.517738Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:590f536d8c0453763f57aacc72a5edeaf309305896aebfc4644e206d1d6fb209","observation_id":"8b9e30fb-d671-4d3e-a172-7c7c1feb909d","resolution":{"observed_at":"2026-08-04T09:47:00.517738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-04T09:47:00.595258Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.595258Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:9169281b6670ba0496ed7a1aba56a69f56ecfd4ca9ce8db57cec932fe9d09beb","observation_id":"ebbe51c2-e2f9-462c-8002-adca5c610659","resolution":{"observed_at":"2026-08-04T09:47:00.595258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:00.711345Z","title":"The im algorithm: a variational approach to information maximization","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.711345Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:e038b8046749c2c95a5c88c099569d5c2a36e55b248c09be8210b89126f9f413","observation_id":"79ada243-e428-4b01-a0c6-9d9098c359d5","resolution":{"observed_at":"2026-08-04T09:47:00.711345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:00.827755Z","title":"Pattern recognition and machine learning, volume 4","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.827755Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:65db1ef787b2081bb6002b1e1067453516975778fb01b70f3b0d60a8ad450915","observation_id":"e10031b5-d67f-4942-a0c9-e4d7b1226e05","resolution":{"observed_at":"2026-08-04T09:47:00.827755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:00.952714Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:00.952714Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:224510927e7e59fc45c6275844e3dda009499a68549497d613ac76bced1477fb","observation_id":"73adf43e-b41b-4c17-8cb2-842e171a65f6","resolution":{"observed_at":"2026-08-04T09:47:00.952714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17551","last_updated":"2025-05-13T16:31:13Z","snapshot_observed_at":"2026-08-07T15:59:30.559392Z","submitted_at":"2025-04-24T13:41:27Z","title":"Unsupervised Urban Land Use Mapping with Street View Contrastive Clustering and a Geographical Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17551","snapshot_observed_at":"2026-08-04T09:47:01.063076Z","title":"Unsupervised urban land use mapping with street view contrastive clustering and a geographical prior","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:01.063076Z"},"links":{"cited_paper":"/paper/2504.17551","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:777acac0f6f7414449e14d9e5f49ffe18d7c7079137a53a7a25d75b335e3deea","observation_id":"62190a45-31fd-42ed-b9f1-f09b24959291","resolution":{"observed_at":"2026-08-04T09:47:01.063076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:01.198438Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:01.198438Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:2bfa357513952e6c5d1e3c966d90f4c822d752ecb594ef2971131c513a365955","observation_id":"5c47f802-6baa-47fb-9c5e-ca3ed8dd87ae","resolution":{"observed_at":"2026-08-04T09:47:01.198438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:01.402900Z","title":"Functional map of the world","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:01.402900Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:8a3b35abde3d8ff87368f9ce67625b0bfd770afebb56849877fd2c0eaaff098c","observation_id":"fc96b5ff-01dd-4ada-a749-8227f8519d9a","resolution":{"observed_at":"2026-08-04T09:47:01.402900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:01.538192Z","title":"Urban atlas land cover land use 2018 (vector), europe","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:01.538192Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:07c3e96cc7a90d6815db47e0da83bda25109bbc4c5af525a33bac3b504f2935c","observation_id":"ab9b717e-8655-4381-8e41-2a2b207924cc","resolution":{"observed_at":"2026-08-04T09:47:01.538192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:01.630110Z","title":"The use of urban analytics in strategic planning – a case study of the greater sydney region plan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:01.630110Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:a92efd46a8cc736e2b6dd8ff2de05f8ebf80cbf6b90d76574f60b8e39b040b8b","observation_id":"50083610-679a-4506-863a-502c252ffaec","resolution":{"observed_at":"2026-08-04T09:47:01.630110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:01.792249Z","title":"Data commons 2024, cdc places, electronic dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:01.792249Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:39b6014f99cbda519f4b8eb90942bc9873a15cdf30b6245509b22c401ea0c5ce","observation_id":"158c3a86-3fcc-41ff-a566-8a0ee3507c55","resolution":{"observed_at":"2026-08-04T09:47:01.792249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:01.916171Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:01.916171Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:e9c39eb312912d537f9e7d5c037123efaea5845296b9aa522e2fde5d2aba5350","observation_id":"ed25b5fc-3fee-407f-81fc-fb546a3e07e3","resolution":{"observed_at":"2026-08-04T09:47:01.916171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:02.038073Z","title":"Postcode level all domestic meters electricity 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:02.038073Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:d4cad2c582cbe67dcdd9469e6938c1de3021d7d2e547ec5146337ed02d9a1d00","observation_id":"6387c7f4-4ab4-412a-b11c-c02534cd5e5c","resolution":{"observed_at":"2026-08-04T09:47:02.038073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19781","last_updated":"2025-04-03T20:20:24Z","snapshot_observed_at":"2026-08-07T17:44:04.541227Z","submitted_at":"2025-02-27T05:45:51Z","title":"RANGE: Retrieval Augmented Neural Fields for Multi-Resolution Geo-Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19781","snapshot_observed_at":"2026-08-04T09:47:02.143085Z","title":"Range: Retrieval augmented neural fields for multi-resolution geo-embeddings","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:02.143085Z"},"links":{"cited_paper":"/paper/2502.19781","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:06018f3f871951017e6e9c5de5be0ccaaa289536cc29e53c166896b6c114813e","observation_id":"75b8e02b-bf9d-421a-a6e8-8e51d41cba22","resolution":{"observed_at":"2026-08-04T09:47:02.143085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:02.225129Z","title":"Climplicit: Climatic implicit embeddings for global ecological tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:02.225129Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:d4ac79804e81f19e27f4764f51ef9d40409db1c79b2dec14489f24f0e1080645","observation_id":"897d965a-1597-4d5c-b4d7-b72d2dbdfa68","resolution":{"observed_at":"2026-08-04T09:47:02.225129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:02.446132Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:02.446132Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:87b52abb2bcaa6e3ff3318519dbbf1f7c4f5d1b32321f906f0d844f77762f6da","observation_id":"49b20ace-1b95-4c9c-b6c1-1c3e6a541c87","resolution":{"observed_at":"2026-08-04T09:47:02.446132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:02.568387Z","title":"Drusch, U","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:02.568387Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:2090e34b795f1e6b5558799a0b877e667847dce212bf18118cf7e1efcc1b076f","observation_id":"47479961-3a1c-462a-b255-63c17d6160d9","resolution":{"observed_at":"2026-08-04T09:47:02.568387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:02.736612Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:02.736612Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:65067f2ff16eaea70c182ed6f22a705f799bb71b673d9b4a355cba89ea824d09","observation_id":"cb90015d-89fe-4895-ac1c-1068c093b9e7","resolution":{"observed_at":"2026-08-04T09:47:02.736612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:02.910517Z","title":"What to align in multimodal contrastive learning? In Proceedings of the International Conference on Learning Representations (ICLR), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:02.910517Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:1adc31258984b00fdf6aa1031b96feaa48868b96a8f4fbb1de0a7176f540942b","observation_id":"910d0a87-da2e-433f-af15-71f41db81177","resolution":{"observed_at":"2026-08-04T09:47:02.910517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:03.023897Z","title":"Uk postcodes with latitude and longitude","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:03.023897Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:e42340bd65f8ac60db0ea346ccc1f66c302effcbf05a5a05dc017fb46b731f2a","observation_id":"1792162f-2189-4907-87d9-dfa590ac6626","resolution":{"observed_at":"2026-08-04T09:47:03.023897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:03.289482Z","title":"SimCSE : Simple contrastive learning of sentence embeddings","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:03.289482Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:84cd26ab4415c75b129d8b3201f3dc16a6c65c5966e021ebaa3c407344461695","observation_id":"8d57a055-cdb5-47aa-91da-1976bebc9385","resolution":{"observed_at":"2026-08-04T09:47:03.289482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:03.458864Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:03.458864Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:8941b7d93f575e50c22dc282715d12ef772476dd7b88c89d01f0c66ecd2250d9","observation_id":"c7fadd3e-bfe8-46af-820f-923fd73ca171","resolution":{"observed_at":"2026-08-04T09:47:03.458864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:03.570898Z","title":"Street view static api","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:03.570898Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:03cb057f6d6ae359fb48cb345936e49fa5d323b3e832debf705464385d4a1e3a","observation_id":"45bcd07c-ada5-4b41-9729-9cc0d3f6638c","resolution":{"observed_at":"2026-08-04T09:47:03.570898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:03.680590Z","title":"Gorelick, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:03.680590Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:281f634879d2e674dbeb494c4dfa5e6b089d568559b519791bc705ddbd71c7b7","observation_id":"f3d3043b-eb1e-4b05-9021-da20b9e8cd2c","resolution":{"observed_at":"2026-08-04T09:47:03.680590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:03.793666Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:03.793666Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:2b991b270e655f8a38988f5c93c243919740404f2f50cf397c6d707df324ba89","observation_id":"00b50550-bc63-4f5a-ac88-8fef0c40ef3d","resolution":{"observed_at":"2026-08-04T09:47:03.793666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:03.898734Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:03.898734Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:4ad41b73aa10969016a5be79b68d9d9eaf10fcd7a121a81fe2b365990805a796","observation_id":"0d2ad4d2-99ac-4bf4-9dbc-81a452acb63c","resolution":{"observed_at":"2026-08-04T09:47:03.898734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-04T09:47:04.007965Z","title":"Gaussian error linear units ( GELUs )","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.007965Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:2aa69262505188e9450f46669317698bdf26c8a1ee0725081b4e9d96c7451d55","observation_id":"b2adb084-f66a-4052-bf87-337380b262e8","resolution":{"observed_at":"2026-08-04T09:47:04.007965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:04.122440Z","title":"Trueskill: a bayesian skill rating system","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.122440Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:962ac8e1a4080e90ab1256556f1dede10ad8b8d8f14b5d7bc0fed717a45f4ce6","observation_id":"5ae37fd2-bfe4-4c41-b1b4-9e5f28894e1a","resolution":{"observed_at":"2026-08-04T09:47:04.122440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:04.199383Z","title":"Evaluating geospatial context information for travel mode detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.199383Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:7a9d3565451a0086e3ecf0649d6def9d96ac463bcd623344352208b1d226f22b","observation_id":"1786d5b9-dadb-421a-918d-0a6c78be5874","resolution":{"observed_at":"2026-08-04T09:47:04.199383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:04.306432Z","title":"Lo RA : Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.306432Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:0d025867b2d4af7e94790b54fb9069d4d74e2fc55a67cbdd342e58c544bea70c","observation_id":"bb6350b9-d8d7-4996-92d8-62321b333797","resolution":{"observed_at":"2026-08-04T09:47:04.306432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18660","last_updated":"2023-11-08T18:25:24Z","snapshot_observed_at":"2026-07-06T16:39:52.551576Z","submitted_at":"2023-10-28T10:19:55Z","title":"Foundation Models for Generalist Geospatial Artificial Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18660","snapshot_observed_at":"2026-08-04T09:47:04.424190Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.424190Z"},"links":{"cited_paper":"/paper/2310.18660","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:3dadc6183aa8991631ccdec42a72c1df49e042f674374b8e7638a18584ef418c","observation_id":"00f42b43-3190-4432-927f-78c38a715fda","resolution":{"observed_at":"2026-08-04T09:47:04.424190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12768","last_updated":"2024-04-19T10:17:10Z","snapshot_observed_at":"2026-08-04T19:42:17.998451Z","submitted_at":"2024-04-19T10:17:10Z","title":"MixLight: Borrowing the Best of both Spherical Harmonics and Gaussian Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12768","snapshot_observed_at":"2026-08-04T09:47:04.546223Z","title":"Mixlight: Borrowing the best of both spherical harmonics and gaussian models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.546223Z"},"links":{"cited_paper":"/paper/2404.12768","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:2bf0afb73013c740276de7b3171127b687c7a00bace7a073190e0a52e591dded","observation_id":"04a3bb23-2162-496d-b2a8-f55a30f366a4","resolution":{"observed_at":"2026-08-04T09:47:04.546223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:04.637989Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.637989Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:be962e35677541debd26f320df64f23bbe84da67c5f41cde6a84b1bf384ef993","observation_id":"41ea55e1-cd8c-4587-8aea-723d852eb641","resolution":{"observed_at":"2026-08-04T09:47:04.637989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:04.747236Z","title":"Satclip: Global, general-purpose location embeddings with satellite imagery","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.747236Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:9a08707108103552238b3ab50714059e015e0f899ef61e0420be202dc8988051","observation_id":"e2545462-10b7-4f9c-976b-f9ad20acba65","resolution":{"observed_at":"2026-08-04T09:47:04.747236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:04.829969Z","title":"Challenges in data-driven geospatial modeling for environmental research and practice","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.829969Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:224426d2e7ff08dac5c00df1eea227b465ca7c263f72d7143b07c1d2cc3ea2a3","observation_id":"397d497b-391d-4120-9b37-1caaf5816371","resolution":{"observed_at":"2026-08-04T09:47:04.829969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:04.928725Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt\\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:04.928725Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:de19e41666657c932cc0687d5da157be41c6a525a40e5d498b52f2aece784630","observation_id":"bf489922-db64-4063-a15a-639e76d35e2c","resolution":{"observed_at":"2026-08-04T09:47:04.928725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.035294Z","title":"Factorized contrastive learning: Going beyond multi-view redundancy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.035294Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:3455a7b73efd2989fe4335029303cb1e0f910d172c78cb58dbb39143f424ecba","observation_id":"330b15a8-5e19-4e42-889c-b6ea8c62b4b6","resolution":{"observed_at":"2026-08-04T09:47:05.035294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16683","last_updated":"2026-04-20T21:20:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-20T19:59:39Z","title":"GAIR: Location-Aware Self-Supervised Contrastive Pre-Training with Geo-Aligned Implicit Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16683","snapshot_observed_at":"2026-08-04T09:47:05.107809Z","title":"Gair: Improving multimodal geo-foundation model with geo-aligned implicit representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.107809Z"},"links":{"cited_paper":"/paper/2503.16683","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:1b09f85a0ac7bbe6ea78ad5433066fb2cdda9942ace7387de2b4b187f6767421","observation_id":"8984444f-9e4c-4f3e-94b5-0f412dbdd7eb","resolution":{"observed_at":"2026-08-04T09:47:05.107809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.204955Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.204955Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:b5ad60e9fe9b921deadedba8a0028f6fe4c4d5d9a1cdcd84860fb575b11aa83c","observation_id":"65d2331d-028c-4191-9868-8dcd4ecc9e2a","resolution":{"observed_at":"2026-08-04T09:47:05.204955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.312632Z","title":"Csp: Self-supervised contrastive spatial pre-training for geospatial-visual representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.312632Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:150b67cb9366137b3b607beb7af1af644484e326ba2740d00ca188a5e9acc51c","observation_id":"c6baa22c-476a-407b-a239-a3069a7ec9ac","resolution":{"observed_at":"2026-08-04T09:47:05.312632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.386483Z","title":"Towards the next generation of geospatial artificial intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.386483Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:b1eb70fa1b1a5439b580e76145cee86cc1946deb1744ebae3eaa6eec73ecc6ee","observation_id":"f28ee70a-6a2b-4ce9-8f1f-a2f4b2909445","resolution":{"observed_at":"2026-08-04T09:47:05.386483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.455024Z","title":"M\\\"uhlematter, Michelle Halbheer, Alexander Becker, Dominik Narnhofer, Helge Aasen, Konrad Schindler, and Mehmet Ozgur Turkoglu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.455024Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:c60dd17c6dfa46cb1e449690a19250678da5e88c70b56bba96029f68b922da38","observation_id":"9a434929-1af4-40c5-9316-e4ef913156d7","resolution":{"observed_at":"2026-08-04T09:47:05.455024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02250","last_updated":"2024-10-03T06:43:09Z","snapshot_observed_at":"2026-08-06T20:12:50.886563Z","submitted_at":"2024-10-03T06:43:09Z","title":"Probabilistic road classification in historical maps using synthetic data and deep learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02250","snapshot_observed_at":"2026-08-04T09:47:05.545930Z","title":"Mühlematter, Sebastian Schweizer, Chenjing Jiao, Xue Xia, Magnus Heitzler, and Lorenz Hurni","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.545930Z"},"links":{"cited_paper":"/paper/2410.02250","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:7750a4aa696934e367d0cb64b7bb00b5ed02564ef5cded54655e6d53e48f1bea","observation_id":"9b0b7a2f-d72c-4ac8-9ebc-1c626ff97eb0","resolution":{"observed_at":"2026-08-04T09:47:05.545930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.634663Z","title":"Mühlematter, Nina Wiedemann, Yanan Xin, and Martin Raubal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.634663Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:1b30ef6a7e90a3d40fa443d952fa87eec9bc1940b4109950238b1647cb9a89fc","observation_id":"316001b7-20b4-447e-9b92-edab7cfcbd4b","resolution":{"observed_at":"2026-08-04T09:47:05.634663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-04T09:47:05.735320Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.735320Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:adeff9c5f5b4389ffba316d232b5355d615745a04f46fa6a287689b7acc11201","observation_id":"11da7ae1-1fee-44e9-9623-dfbfa47e8532","resolution":{"observed_at":"2026-08-04T09:47:05.735320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.816001Z","title":"Planet dump retrieved from https://planet.osm.org","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.816001Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:418427c9b2246e0086c7bbec823348f35ce7fe71121a523517e173ab9e796e8f","observation_id":"ce934631-21e7-46b7-9f04-28af10f3fbf6","resolution":{"observed_at":"2026-08-04T09:47:05.816001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.881501Z","title":"Oshan, Ziqi Li, Wei Kang, Levi J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.881501Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:74a287d945ec2f97d4f8a582cea585ced994d5bf6f32b207bd3fb900252925cd","observation_id":"7f07520f-88c6-4660-be26-e3f8efac3ae1","resolution":{"observed_at":"2026-08-04T09:47:05.881501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:05.951080Z","title":"PyTorch : an imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:05.951080Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:8d3fd9cf9f38a9ff6b1f05a339ea453faa4205b0758c6c428eea0e900497bf9a","observation_id":"b9bab2ac-9252-4b22-b9b2-8766198ad5ad","resolution":{"observed_at":"2026-08-04T09:47:05.951080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.006071Z","title":"Pedregosa, G","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.006071Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:79a40c917bf31d112ebbe10e9a42aadfa7c0a5d1dea22acc4f8119c9c909fc3d","observation_id":"62ac29f9-5e79-445c-8add-d4176804086d","resolution":{"observed_at":"2026-08-04T09:47:06.006071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.073258Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.073258Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:c659ef6525bfac6afdb0c3310ded0cbbb3a31bdda2c2271ef94d47dd27847a35","observation_id":"acb51044-13a4-404a-af95-0152acb08bca","resolution":{"observed_at":"2026-08-04T09:47:06.073258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.141280Z","title":"A stochastic approximation method","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.141280Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:c50930f34a725977f04a2b057db6727d2f6bc7831a5e8e9ea312a949963ef5cd","observation_id":"50bb1d21-c301-49e5-ab63-b59bc4df913a","resolution":{"observed_at":"2026-08-04T09:47:06.141280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.240053Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.240053Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:18341ae0aa0f349c69f1bdfc6fa5f4fd97b01e1b1e5462d4e942a2151bd740d6","observation_id":"551db35f-9b53-4989-90d2-a9ea3cb491cc","resolution":{"observed_at":"2026-08-04T09:47:06.240053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.316326Z","title":"Geographic location encoding with spherical harmonics and sinusoidal representation networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.316326Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:3585e3dd319cb16af0181a31fe9ac212dc09af30f60e81053235bbf69f272d64","observation_id":"69e4b197-5184-4eff-ae11-fb6351aa41f9","resolution":{"observed_at":"2026-08-04T09:47:06.316326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22721","last_updated":"2024-10-30T06:09:22Z","snapshot_observed_at":"2026-08-06T14:56:51.233970Z","submitted_at":"2024-10-30T06:09:22Z","title":"Community search signatures as foundation features for human-centered geospatial modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22721","snapshot_observed_at":"2026-08-04T09:47:06.356035Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.356035Z"},"links":{"cited_paper":"/paper/2410.22721","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:df1cffd9ea1434d9951aa1c76e8f48db9d67b2bfb928def4d7da14a9e3d341fb","observation_id":"35fd0430-1f69-4129-9f9a-7df5003e53ae","resolution":{"observed_at":"2026-08-04T09:47:06.356035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.408598Z","title":"Fourier features let networks learn high frequency functions in low dimensional domains","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.408598Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:fe3508e458c02bf68770ef1a639bfb31d25528d2273d2cc814c392b74f690189","observation_id":"2aeb6893-0044-4042-9ead-d2bfa8aceafb","resolution":{"observed_at":"2026-08-04T09:47:06.408598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.493041Z","title":"World Urbanization Prospects: The 2018 Revision","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.493041Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:63bdb971722dcc9ed5e6c7a0aa0221723f5e954231420d61deee2bdf34c3a071","observation_id":"84c3fc80-b535-494d-8cb3-3ef8675ae97c","resolution":{"observed_at":"2026-08-04T09:47:06.493041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.575143Z","title":"World Cities Report 2024: Cities and Climate Action","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.575143Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:d6c8ede6d0ac09d95650d48bb61bf732e801843b8d5fef3e27936cbb4a0a90a1","observation_id":"4450cc1e-3b2f-4da1-95ca-a624a04a4432","resolution":{"observed_at":"2026-08-04T09:47:06.575143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.599963Z","title":"Geological Survey, Earth Resources Observation and Science Center","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.599963Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:29784d5a8365de2d8d64876d72e5b4880ad88492665d8b61351032c733466b46","observation_id":"8d3ea7e1-ddd3-4b74-bddb-048ae9bed9cd","resolution":{"observed_at":"2026-08-04T09:47:06.599963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.758507Z","title":"The iNaturalist species classification and detection dataset","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.758507Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:5abe4c128b515f6eb5bbafa30a2b7f193276f7ab2eaff733e6ad8dc9214ca093","observation_id":"faff5fd8-7267-4153-a89b-3b0dfc047f7b","resolution":{"observed_at":"2026-08-04T09:47:06.758507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:06.892929Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:06.892929Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:13e147add987f0dcb8bc46a60d6e3f5e36ad56be49979a66526e4576314473cd","observation_id":"7c449eb6-c36b-431b-a457-b0b7a4a1b0ab","resolution":{"observed_at":"2026-08-04T09:47:06.892929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:07.037956Z","title":"Geoclip: Clip-inspired alignment between locations and images for effective worldwide geo-localization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:07.037956Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:5145f6651d323bf67801a821351ddefab68c8dc78b513f02d8e4d90c66c79a6a","observation_id":"78af4288-5082-46fe-a3c5-a7fcf23b57ba","resolution":{"observed_at":"2026-08-04T09:47:07.037956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:07.247174Z","title":"Combining deep learning and street view imagery to map smallholder crop types","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:07.247174Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:ea60dbc8c8870e3d4407f4386b3f81e99a7f7a4ab2023ad51e158487ccec3f87","observation_id":"29824d79-0c05-4a9e-b2e1-ebcddef65c6e","resolution":{"observed_at":"2026-08-04T09:47:07.247174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:07.401906Z","title":"Multi-modal contrastive learning of urban space representations from poi data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:07.401906Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:792469ec21527a93dd3dd716da781d8774484c7fc2c6cf29a18a035982417725","observation_id":"c72e2f60-1ac8-4fbb-8a49-51175793b5d1","resolution":{"observed_at":"2026-08-04T09:47:07.401906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07044","last_updated":"2023-05-29T13:57:01Z","snapshot_observed_at":"2026-08-07T06:07:06.354681Z","submitted_at":"2022-11-13T23:38:27Z","title":"SSL4EO-S12: A Large-Scale Multi-Modal, Multi-Temporal Dataset for Self-Supervised Learning in Earth Observation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.07044","snapshot_observed_at":"2026-08-04T09:47:07.577083Z","title":"Ssl4eo-s12: A large-scale multi-modal, multi-temporal dataset for self-supervised learning in earth observation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:07.577083Z"},"links":{"cited_paper":"/paper/2211.07044","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:0a25c3e93bb1bdf5311d51ad560582bd6eaf853a9d8fe49e499090b0ca1b74ea","observation_id":"ccfb40d2-6801-4994-9b7f-9d00adf2b3c9","resolution":{"observed_at":"2026-08-04T09:47:07.577083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:07.755290Z","title":"Urban2vec: Incorporating street view imagery and pois for multi-modal urban neighborhood embedding","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:07.755290Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:771dca075cbc2371df76e84d3cddec3e44740097846f152d86dbe1e93db9c87d","observation_id":"ff5254c4-a34a-4a2e-9b9e-3cc7b9e2a987","resolution":{"observed_at":"2026-08-04T09:47:07.755290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3929/ethz-b-000738075","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spatio–temporal effects in GeoAI : From predictability to evaluation","venue":"Repository for Publications and Research Data (ETH Zurich)","work_id":"9cd744f4-62f3-4b8d-9e7e-2665d9ac3077","year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:07.910805Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:0db60accb9a76dd18c663a71327d14b1f47559fa26940a26423c236a529a52b4","observation_id":"fb9cad1f-eaab-4b78-9382-bdcd526a3cdf","resolution":{"observed_at":"2026-08-04T09:49:26.445342Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1004.2515","last_updated":"2010-04-14T22:12:52Z","snapshot_observed_at":"2026-08-03T20:33:54.082561Z","submitted_at":"2010-04-14T22:12:52Z","title":"Nonnegative Decomposition of Multivariate Information","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1004.2515","snapshot_observed_at":"2026-08-04T09:47:08.053736Z","title":"Williams and Randall D","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:08.053736Z"},"links":{"cited_paper":"/paper/1004.2515","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:c32f0c3ea2dfa85d55e5b155b656de598515431db872d12439705461fb3f9235","observation_id":"0659e166-8a1c-47f5-86cd-5cb5939775dc","resolution":{"observed_at":"2026-08-04T09:47:08.053736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:08.171880Z","title":"London house price data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:08.171880Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:5d76bfc88f1076bc047ba2aa1ab957be568ad9055bfab595dcd643569ab96785","observation_id":"009a8614-6281-4290-bb75-05c871f3a399","resolution":{"observed_at":"2026-08-04T09:47:08.171880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07597","snapshot_observed_at":"2026-08-04T09:47:08.312141Z","title":"C-pack: Packaged resources to advance general chinese embedding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:08.312141Z"},"links":{"cited_paper":"/paper/2309.07597","citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:eb17d37590bc420f191f35edcb91155878e45b817318c4cc556f851f1bc7a39b","observation_id":"3ab6a91f-e674-4ba0-8be9-fa308c6ecbff","resolution":{"observed_at":"2026-08-04T09:47:08.312141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:08.509031Z","title":"Mapping fine scale urban housing prices by fusing remotely sensed imagery and social media data","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:08.509031Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:80d82cc03158e4ceb6943752e26564acf7a0f5158070f45ce4772f48cb3eadbd","observation_id":"2a368db4-7b10-468b-a425-e3ad3f4cbdcf","resolution":{"observed_at":"2026-08-04T09:47:08.509031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:08.710330Z","title":"Gps2vec: Towards generating worldwide gps embeddings","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:08.710330Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:b0de687472fc5417978d97541ae780c2c2b5be157cd44d2ed9ce0d84c8650b18","observation_id":"d8a4486d-175f-4a53-95d5-d4480b0e2582","resolution":{"observed_at":"2026-08-04T09:47:08.710330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:08.899973Z","title":"Learning multi-context aware location representations from large-scale geotagged images","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:08.899973Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:5edb8c0853eb5bc5964fcf457f64200401787291f76a9265f11dfd350a03e2eb","observation_id":"fc8780c5-10c2-4d9f-bc6f-f54aabc6a4c2","resolution":{"observed_at":"2026-08-04T09:47:08.899973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:08.969695Z","title":"Multimodal contrastive training for visual representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:08.969695Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:2ea14584c4126ded9e24eab6b8b75f52b8aba245bc97445cc0496fd7c13330d0","observation_id":"49430148-4e56-4b6b-b292-6b7a0c8c037d","resolution":{"observed_at":"2026-08-04T09:47:08.969695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:09.076054Z","title":"The equal earth map projection","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:09.076054Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:34abb7ab3a01887c3cd00d8a84124ff8c627d0dd4ed74cf17a382404e923de1a","observation_id":"1c25d9d3-8399-466e-bac1-206b1640e424","resolution":{"observed_at":"2026-08-04T09:47:09.076054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:09.118964Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:09.118964Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:731853449ad1e79f4b629e5d69e372b596981104b41aa57fd4a258f664b178cf","observation_id":"9118786b-a247-41d8-996a-f0dc15cb70d4","resolution":{"observed_at":"2026-08-04T09:47:09.118964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:09.175055Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:09.175055Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:25aaa00bb0051f49d6be07e2f3da05f9b0498d9fc5ce7ab976717b9c8a8b6da1","observation_id":"146dbbec-8440-46d8-ade6-18409348eeb9","resolution":{"observed_at":"2026-08-04T09:47:09.175055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:09.226785Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:09.226785Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:eb98fad39dabb30ec9e778d2fd22553e8dfae4b2d37196ee489b324895e99f36","observation_id":"f56e399a-84af-4acd-96a2-8c796eb7afcc","resolution":{"observed_at":"2026-08-04T09:47:09.226785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:47:09.321775Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-04T09:47:09.321775Z"},"links":{"citing_paper":"/paper/2510.13774"},"observation_digest":"sha256:d105e4b901fe6e92668de212fd5d08c81968795b64f8edaeac676a17e89a8778","observation_id":"06f642b9-9574-4d3d-b7c4-3fc1bde0cfff","resolution":{"observed_at":"2026-08-04T09:47:09.321775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.13774","last_updated":"2026-05-29T21:38:11Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T09:46:55.263767Z","submitted_at":"2025-10-15T17:26:24Z","title":"UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":80,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 2 inbound Pith citation observations for arXiv:2510.13774."}