{"as_of":"2026-08-18T18:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab7f0a81223e5e71bd3ec79cb90ed6b3d6f96e8bf3d7dd2562eb9330d6a726b5","coverage":[{"denominator":86,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":86,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:21:14.250669Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T22:49:02.844739Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T19:07:35.342402Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"cited_work":{"arxiv_id":"2507.13812","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13812","snapshot_observed_at":"2026-07-10T19:07:35.342402Z","title":"Skysense v2: A unified foundation model for multi-modal remote sensing","venue":"cs.CV","work_id":"0b909365-686e-4b94-b779-3653ea6e2871","year":2025},"citing_paper":{"arxiv_id":"2602.12652","last_updated":"2026-04-30T01:43:16Z","snapshot_observed_at":"2026-08-16T20:17:52.262322Z","submitted_at":"2026-02-13T06:24:55Z","title":"CBEN -- A Multimodal Machine Learning Dataset for Cloud Robust Remote Sensing Image Understanding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T22:58:49.991155Z"},"links":{"cited_paper":"/paper/2507.13812","citing_paper":"/paper/2602.12652"},"observation_digest":"sha256:7e8e864ef1a6fe8d5303295fc7e746a518827483e47b618a580a840db0c36330","observation_id":"c2fa9af4-f64f-458d-8fe8-775f780626bf","resolution":{"observed_at":"2026-05-15T23:00:22.931089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13812","snapshot_observed_at":"2026-07-11T22:49:02.844739Z","title":"Yingying Zhang, Lixiang Ru, Kang Wu, Lei Yu, Lei Liang, Yansheng Li, and Jingdong Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03949","last_updated":"2026-08-06T06:36:23Z","snapshot_observed_at":"2026-08-14T22:22:16.285693Z","submitted_at":"2026-07-04T16:52:34Z","title":"TESSERA v2: Scaling Pixel-wise Earth Foundation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T22:49:02.844739Z"},"links":{"cited_paper":"/paper/2507.13812","citing_paper":"/paper/2607.03949"},"observation_digest":"sha256:b22cae12d130359e0a37d7e7d45c6fa9416de98e1de9a0c68261e2340027bbb0","observation_id":"d6429a49-fcfa-4941-a7f1-bbc19ecc3e5a","resolution":{"observed_at":"2026-07-11T22:49:02.844739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"cited_work":{"arxiv_id":"2507.13812","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13812","snapshot_observed_at":"2026-07-10T19:07:35.342402Z","title":"Skysense v2: A unified foundation model for multi-modal remote sensing","venue":"cs.CV","work_id":"0b909365-686e-4b94-b779-3653ea6e2871","year":2025},"citing_paper":{"arxiv_id":"2607.07758","last_updated":"2026-07-08T14:31:02Z","snapshot_observed_at":"2026-08-16T10:16:43.940323Z","submitted_at":"2026-07-08T14:31:02Z","title":"Scalable and Trustworthy Earth Observation Foundation Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-10T18:58:32.854964Z"},"links":{"cited_paper":"/paper/2507.13812","citing_paper":"/paper/2607.07758"},"observation_digest":"sha256:e6ef63b53f6b8be6b19778bf95f5b8e84fd204853c136d962e1c58656cc3b97c","observation_id":"9c676a0b-7d2e-4884-9d09-815914f08980","resolution":{"observed_at":"2026-07-10T19:07:35.343671Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.13812/citation-record","integrity":"/paper/2507.13812/integrity","json":"/paper/2507.13812/citation-record.json","paper":"/paper/2507.13812"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:13.904868Z","title":"Self- supervised material and texture representation learning for remote sensing tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.904868Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:0e70b9428c6cfbed6c5aa39c12202fd065f456eea9299cb6d20146a6876b4cb9","observation_id":"ba463af9-5856-4eb8-842a-b27bd8359a46","resolution":{"observed_at":"2026-08-06T16:21:13.904868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14123","last_updated":"2025-05-09T09:50:12Z","snapshot_observed_at":"2026-08-15T16:58:24.715389Z","submitted_at":"2024-12-18T18:11:53Z","title":"AnySat: One Earth Observation Model for Many Resolutions, Scales, and Modalities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14123","snapshot_observed_at":"2026-08-06T16:21:13.910052Z","title":"AnySat: An Earth observation model for any resolutions, scales, and modalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.910052Z"},"links":{"cited_paper":"/paper/2412.14123","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:85455a9c15737bccd7d631a91a7da1cc14fd23c2bcb7ceb6d37f0f791282b285","observation_id":"cc29ad2f-1b5b-482d-92ce-21b721d8180c","resolution":{"observed_at":"2026-08-06T16:21:13.910052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:13.914654Z","title":"Geography-aware self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.914654Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:8619213898aa7d373d825b3f2e9b894700eea65d0fdd8bc38f0b338a7ab52829","observation_id":"002f7b0f-623e-4df0-abf0-ce79687f5a4c","resolution":{"observed_at":"2026-08-06T16:21:13.914654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:13.919046Z","title":"Satlaspretrain: A large- scale dataset for remote sensing image understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.919046Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:df2ff1d34a44d8b2a2a72a67c6b25950e49011c2150c64d40301b3424a8e4a93","observation_id":"39a55ece-38bb-4e45-b45e-466fd015feb6","resolution":{"observed_at":"2026-08-06T16:21:13.919046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:13.923245Z","title":"A multi- scale weakly supervised learning method with adaptive on- line noise correction for high-resolution change detection of built-up areas","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.923245Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:a5d6b5b9e3bbde9bdfd1c23fa3398018b41bfb1bfaa2b4bd4d5d30f8a7ecbbdd","observation_id":"64723a26-e79d-4329-9ff7-8b5e0d76e5cb","resolution":{"observed_at":"2026-08-06T16:21:13.923245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:13.927401Z","title":"Unsupervised learning of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.927401Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:43ada23acc8aabe9ab6d046740203745e009d2b1d91b204b4027713a31e5b5e7","observation_id":"b1464326-fd10-4f2b-bf64-ab7bc1fb9fcc","resolution":{"observed_at":"2026-08-06T16:21:13.927401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:13.931441Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.931441Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:afc008da9a084f1272a14ad669ef72f4236d3272ba491f1453ac392d107157e7","observation_id":"8dbedf7e-91d0-4571-84d4-53c2471d8130","resolution":{"observed_at":"2026-08-06T16:21:13.931441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05215","last_updated":"2024-08-12T03:33:12Z","snapshot_observed_at":"2026-08-16T15:41:17.978235Z","submitted_at":"2023-04-11T13:33:45Z","title":"A Billion-scale Foundation Model for Remote Sensing Images","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05215","snapshot_observed_at":"2026-08-06T16:21:13.935816Z","title":"A billion-scale foundation model for remote sensing images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.935816Z"},"links":{"cited_paper":"/paper/2304.05215","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:54182ff921775addd203a2d5ac1ea52cc5f9b4f3d37809747de212c353f72d58","observation_id":"48319c15-b5a1-4410-99aa-9c0046f4f2d0","resolution":{"observed_at":"2026-08-06T16:21:13.935816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.449065Z","title":"A spatial-temporal attention- based method and a new dataset for remote sensing image change detection","venue":null,"work_id":"7cd8a9d7-48bb-43b5-baf5-91e7177c0a82","year":2020},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.940164Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:b8662e1eccf193a56104e6c46df24050ac0e14a8a87a3b7f5cab60b00e3783e7","observation_id":"bbc2e246-141a-410a-985e-1b88eb1e8492","resolution":{"observed_at":"2026-08-06T16:21:15.454383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.433977Z","title":"Remote sensing im- age change detection with transformers","venue":null,"work_id":"0953027d-1287-4524-ba22-20baf525b0c0","year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.944195Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:a74a53e7583d36b000555084817bb7079c44f1bc339ef2b9085f15c564d41d46","observation_id":"c6fbd82f-f83b-45ec-be4d-4fa47503bb66","resolution":{"observed_at":"2026-08-06T16:21:15.438705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.419249Z","title":"Collaborative global-local networks for memory-efficient segmentation of ultra-high resolution images","venue":null,"work_id":"6f38f7d1-7ce4-4878-8839-e4ef06385e07","year":null},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.948271Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:559ed1bdc85e036bd071e5117095abd003ad8c96e2827e574f1fc5e2e7013583","observation_id":"7f17f884-c88e-4178-b8e1-1e6b5a1096bb","resolution":{"observed_at":"2026-08-06T16:21:15.423775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.404566Z","title":"A survey on object detec- tion in optical remote sensing images","venue":null,"work_id":"94271d80-3e6a-4c6e-8782-5d6978fa1596","year":2016},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.952418Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:3704be0b1708746a8d63dd7a9ee215e008ecf6ddac89e297f6d54e7e322ff24c","observation_id":"9acf26c9-280d-4ed3-874d-a37333034483","resolution":{"observed_at":"2026-08-06T16:21:15.409301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.389447Z","title":"Remote sens- ing image scene classification: Benchmark and state of the art","venue":null,"work_id":"10d9823e-0990-41c5-8cbb-f911c966c180","year":2017},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.956347Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:00e89f137524888406aace20e392f4819af5840cdd08a376b88d4fee8477ff69","observation_id":"6bcf959a-fe6f-412c-b16a-5c7f299df4be","resolution":{"observed_at":"2026-08-06T16:21:15.394330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:13.960158Z","title":"Anchor-free oriented proposal generator for object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.960158Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:d63d20f0963dcb0869cb9e7a63482bd1095fdf4967b96788a491e232677ceff9","observation_id":"548b61d2-3977-4ff1-a491-2086ae449c7f","resolution":{"observed_at":"2026-08-06T16:21:13.960158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.364225Z","title":"Satmae: Pre-training transformers for tem- poral and multi-spectral satellite imagery","venue":null,"work_id":"164fa1c2-6b2b-4c82-a2d8-9aebbf2f41ce","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.963965Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:6741fdd50d520740bcb3838373113ba2d20d3e0107e0df74a1e1e29a1ce0375b","observation_id":"14716760-c0d1-43d1-a1ce-0eb1147ec386","resolution":{"observed_at":"2026-08-06T16:21:15.369331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.349296Z","title":"Vision transformers need registers","venue":null,"work_id":"ba07313d-834c-4063-b8ef-09a090e52d83","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.967977Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:5ccbd41fb61d704219528126dcab9faf7f503e79e237e8074f40bf16bba85991","observation_id":"74594aeb-1459-442a-a1cf-48c5c76a6281","resolution":{"observed_at":"2026-08-06T16:21:15.354150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.334253Z","title":"Urban change detection for multispectral earth observation using convolutional neural networks","venue":null,"work_id":"dd4732fd-ebf0-45e1-8e8d-fb4e2ae43a66","year":2018},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.971964Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:f4e3c2d63d5b8cdeb5ebd82ce0864756a04c436c66f9d26456f7234588e8b091","observation_id":"d57b28e5-b8d9-4a71-aefc-43baab3fc937","resolution":{"observed_at":"2026-08-06T16:21:15.338972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T16:21:13.975831Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.975831Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:c880f1121b52edc22e297e4ad108f3f0ce8e5b669cf2d28125b2201cfbc99043","observation_id":"5c37a863-a08a-4a0f-bbb0-2f796bc5da90","resolution":{"observed_at":"2026-08-06T16:21:13.975831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03961","last_updated":"2022-06-16T20:36:07Z","snapshot_observed_at":"2026-08-14T22:45:56.335948Z","submitted_at":"2021-01-11T16:11:52Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.03961","snapshot_observed_at":"2026-08-06T16:21:13.979944Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.979944Z"},"links":{"cited_paper":"/paper/2101.03961","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:7a59aafa59ad0352499785e5327e3ea54b588defd0def398fda9edbc799641a7","observation_id":"0a3a32e6-8002-4d37-a3b9-52ef67ff02f5","resolution":{"observed_at":"2026-08-06T16:21:13.979944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.319440Z","title":null,"venue":null,"work_id":"1b44e1b3-df85-41f5-bb36-dbb72b27af36","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.984346Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:677e0f6551c14d9b6d2140041be552656eddeb92a439d6dedd7b89f34f8e43c5","observation_id":"d0cf9ce5-8014-4553-81d5-b6aae9a63040","resolution":{"observed_at":"2026-08-06T16:21:15.324075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.303311Z","title":"Multi-modal temporal attention models for crop mapping from satellite time series","venue":null,"work_id":"13ce9b08-b785-45f3-ae08-90f680b01b0a","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.989196Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:46b4180741997d91cf991f8d59eb8695366c54f3dfeb4db298cbd90527f25867","observation_id":"96896739-3c85-41f0-80b0-a190d2a6ca13","resolution":{"observed_at":"2026-08-06T16:21:15.308671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.288490Z","title":"Bootstrap your own latent-a new approach to self-supervised learning","venue":null,"work_id":"cbe1ae62-3b0f-488d-bae6-1dec5e185c0d","year":2020},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.993451Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:a31ac27968800a796f3e793421c1d7d41be55641a41af85956b3f5f67ce8c487","observation_id":"0291ad69-a549-47d5-b3d2-a3374242f41e","resolution":{"observed_at":"2026-08-06T16:21:15.293236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.272937Z","title":"Isdnet: Integrating shallow and deep networks for efficient ultra-high resolution segmentation","venue":null,"work_id":"4bbab71d-9217-44f9-9729-0da666bf8aca","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:13.997571Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:2f01dad7185cb1dbbd100d977ed64f7f4608f505466d61c3b9aa599fb6b59f22","observation_id":"139fd756-f7d9-4047-b6ac-d2b980e680fd","resolution":{"observed_at":"2026-08-06T16:21:15.277830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.258453Z","title":"Skysense: A multi- modal remote sensing foundation model towards universal interpretation for earth observation imagery","venue":null,"work_id":"ea041da4-410e-475e-bc15-1d120a43962e","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.001512Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:90124101e8307959008daaa3a6f9d4fc7dc551b85a973d199115f79e37f59c2d","observation_id":"9653bbc5-eb9d-48e7-b64f-dae444bb244f","resolution":{"observed_at":"2026-08-06T16:21:15.262760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.244142Z","title":"Unitr: A uni- fied and efficient multi-modal transformer for bird’s-eye- view representation","venue":null,"work_id":"569827ae-d5cc-4226-b84a-f876ce2eb57a","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.005409Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:e2c9f2e9e2e1a352516e58a41342faf700dc64d161de648433bee37c92bc288f","observation_id":"402f5b14-1712-4f13-884d-0f99ee7cf38b","resolution":{"observed_at":"2026-08-06T16:21:15.248394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.229880Z","title":"Bridging remote sensors with multisensor geospatial foundation models","venue":null,"work_id":"2f02cc0a-13d9-4b58-af96-bb7ef82345c1","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.009172Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:c9493fe897d337e4054069e7d1c08ab39882d320f06bb5480d1ce110542c1f10","observation_id":"5a92b04e-5f77-4d0a-b480-333742a81ca0","resolution":{"observed_at":"2026-08-06T16:21:15.234486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.215132Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":"9a65dc44-1c67-406e-979f-c707fb16ae04","year":2020},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.013012Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:b6f82964f26185fd3da1a489fac9891c8ad7a05b971da600ce2163c39ab4a4cd","observation_id":"c09e2e93-d618-40f3-8d37-69b6fd557c95","resolution":{"observed_at":"2026-08-06T16:21:15.220002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.200513Z","title":"Spectralgpt: Spectral remote sensing foundation model","venue":null,"work_id":"bcce4e2e-fc31-4bf5-ac41-cdeb01409eca","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.016948Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:e9b18ec231f4206617e963a10e8d529ebb9f194771db0fc0d3721c6a018b5c06","observation_id":"55577f2d-5ab0-46f5-85b9-ae1e6f30f16b","resolution":{"observed_at":"2026-08-06T16:21:15.205029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.186098Z","title":"Unsuper- vised domain adaptation using a teacher-student network for cross-city classification of sentinel-2 images","venue":null,"work_id":"3de8e031-bf70-4722-a54d-49532c1e07c4","year":2020},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.020614Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:7ab687ccc5739f296c5879dacffa2645ca28c0560c370f7e99c2b80418167ace","observation_id":"7a81a7db-79a9-4bd7-bbbc-5f02784e5dde","resolution":{"observed_at":"2026-08-06T16:21:15.190367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.172168Z","title":"Toward accurate mapping of 30-m time-series global imper- vious surface area (gisa)","venue":null,"work_id":"d66fcb3c-3aef-4ae7-932b-a2920310746f","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.024486Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:226d51daf68cc10d6eb353172a74c8d98168048691b97af9b27f2f600e0b8459","observation_id":"e86aa585-b795-4a77-a27f-1fac031f809e","resolution":{"observed_at":"2026-08-06T16:21:15.176408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.157806Z","title":"Joseph Hughes and Robert H","venue":null,"work_id":"c64c28d2-de82-4854-b365-7ac2a1c43214","year":2019},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.028406Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:9e0f5b5a7a92b076ebb6f312bfc1423e5e2021b8fbbe5b1928e549cb3454c9bb","observation_id":"77feeb2e-5bb6-4885-9fda-6376bdfe3c4d","resolution":{"observed_at":"2026-08-06T16:21:15.162084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.142759Z","title":"Tutel: Adaptive mixture-of-experts at scale, 2022","venue":null,"work_id":"34c23a9a-1aaa-4673-894e-41b6ce128539","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.032329Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:05ffdd9b7f1da94255bcceaa65334a041a6a6b9b254e6a5be2ab849c65c83e75","observation_id":"abb95afc-217e-4d49-9678-3b75cf8bdebc","resolution":{"observed_at":"2026-08-06T16:21:15.147604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.127713Z","title":"Jacobs, Michael I","venue":null,"work_id":"c8eff86a-ddae-407b-834c-2ae876128a59","year":1991},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.036244Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:c4fb502963c88df9e7facf75d14061633a5e04863a5bc8d4e6e46214cf3ebddd","observation_id":"0aa780e5-bc9a-49a5-9530-830dbcf8b282","resolution":{"observed_at":"2026-08-06T16:21:15.132430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.112601Z","title":null,"venue":null,"work_id":"f9d5b75c-57fb-45d3-8464-da9d5776a744","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.040036Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:2a3123c038ae2ec73f30f56c57efc98bc6e8b641b1b3312ee733244d9ff658cc","observation_id":"31c002ee-85a8-42b7-9fdf-aea056eead8a","resolution":{"observed_at":"2026-08-06T16:21:15.117308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.094875Z","title":"Vi- sual prompt tuning","venue":null,"work_id":"6c537738-c42f-4baf-838a-13936dafda68","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.043852Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:341bd51efe914087b866eb65c6927325545a43411c0d673db7545fc8829c97db","observation_id":"a17c30e3-ee4e-4be6-9423-953bda563412","resolution":{"observed_at":"2026-08-06T16:21:15.100593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.077190Z","title":"Object detection in optical remote sensing images: A survey and a new benchmark","venue":null,"work_id":"ef959e8a-d6f9-4a2e-b59b-9d46e4b8c833","year":2020},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.048065Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:4149511042607ba3329f694051c8ac2e2dc7a1368ce91d7658f3afa7de0a6bd9","observation_id":"e3e918c6-412b-4846-a86b-73639a4f229f","resolution":{"observed_at":"2026-08-06T16:21:15.082028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.062421Z","title":"Ori- ented reppoints for aerial object detection","venue":null,"work_id":"c3541b8e-14cf-40c9-8ccb-05ed5c8b2f4a","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.051967Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:164b66ed178d9c0a98e1d43c5583a8739b8992b4f4deaa2a7225a2b35a8aec3c","observation_id":"53d66b6c-ce83-47b8-abe6-9cc78cd27c95","resolution":{"observed_at":"2026-08-06T16:21:15.066668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.047691Z","title":"S2mae: A spatial-spectral pretraining foundation model for spec- tral remote sensing data","venue":null,"work_id":"0caf335b-640e-4101-bd30-d817ea568d38","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.055844Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:44780ebe123ecb03df74b6527f5775bde5a733118c2ac06ba81fdae20114d60f","observation_id":"b9fea1e8-2ddb-4ff6-be02-bddcce38a3d3","resolution":{"observed_at":"2026-08-06T16:21:15.052370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.033060Z","title":"Masked angle-aware autoencoder for remote sensing images","venue":null,"work_id":"6bcf5495-0961-44d0-b9aa-0fabc8ab8f76","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.059777Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:9ffe85c8acafbd11b91da88a6c9e6d1c5df0aecad61f685b3aa2ebcceb2f5e61","observation_id":"de76f34b-3fea-465e-b860-64fc5e93bd47","resolution":{"observed_at":"2026-08-06T16:21:15.037534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:15.017821Z","title":"See- ing beyond the patch: Scale-adaptive semantic segmentation of high-resolution remote sensing imagery based on rein- forcement learning","venue":null,"work_id":"c7993bca-2b2c-4736-b6eb-6f998f0b6a8f","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.063865Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:3ec10f405c0a7656417c9715df89c8ebb17daf47b3be20723d53afa5a3e4f998","observation_id":"619ba2ad-b435-4cb6-b426-f8cca961ee2f","resolution":{"observed_at":"2026-08-06T16:21:15.022691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.067777Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.067777Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:bc24904d746748767ba707217bfb46e87abcc589988ce574928c73eb75c59ec7","observation_id":"b2df626e-3182-407d-a469-7626cf66c709","resolution":{"observed_at":"2026-08-06T16:21:14.067777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.990993Z","title":"Swin transformer v2: Scaling up capacity and resolution","venue":null,"work_id":"2692fe7a-fbc5-40e7-be9a-71eadaefa706","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.071687Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:259815276d34d19736b050f103f40cc8c99be9ed3e0907446e1094d5c4bd5bd6","observation_id":"ea49c95e-247b-4cc2-b90b-994ee66bacde","resolution":{"observed_at":"2026-08-06T16:21:14.995350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05382","last_updated":"2024-02-08T03:46:32Z","snapshot_observed_at":"2026-08-16T14:20:22.771867Z","submitted_at":"2024-02-08T03:46:32Z","title":"Task-customized Masked AutoEncoder via Mixture of Cluster-conditional Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05382","snapshot_observed_at":"2026-08-06T16:21:14.075628Z","title":"Task-customized masked autoencoder via mixture of cluster-conditional ex- perts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.075628Z"},"links":{"cited_paper":"/paper/2402.05382","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:1bab7d2300c1dd683b72f0487b70d78187a3c488966fc5b05fa6e838e1738f5f","observation_id":"af74101d-1fe5-417f-ac70-bfeac841e88a","resolution":{"observed_at":"2026-08-06T16:21:14.075628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.976675Z","title":"Fully convolutional networks for semantic segmentation","venue":null,"work_id":"77761b60-75c6-416f-bf98-b0f5dd5011ec","year":2015},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.079995Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:986c9c161e5f2e525ac730e42476dfd05470ae304f98f55e225173a4a448ff0b","observation_id":"e50faac6-eba6-4c5a-a6c5-9f93c3a39f37","resolution":{"observed_at":"2026-08-06T16:21:14.980899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.963088Z","title":"Sgdr: Stochastic gradient descent with warm restarts","venue":null,"work_id":"13bc2c2c-e3a6-4911-b3e9-f50424f91b5f","year":2016},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.083978Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:a986011361547bd1340b8d98d1c17d0dc84b21a3b182f6259d6e21c8fd0116a9","observation_id":"afc172b9-5f29-4294-b9f4-604cd4469a4b","resolution":{"observed_at":"2026-08-06T16:21:14.967221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T16:21:14.087827Z","title":"Fixing weight decay reg- ularization in adam","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.087827Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:4fb87bd0f42f2b3e23632ea727e2a2f5a17d1aa0dd6f3ecce78d81d678e4305d","observation_id":"06673f9b-308a-494a-aad6-17746fc32c4c","resolution":{"observed_at":"2026-08-06T16:21:14.087827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.949454Z","title":"Land cover change detection with heterogeneous remote sensing images: Review, progress, and perspective","venue":null,"work_id":"7b504cda-c30e-4ecb-a8a0-89978efc1c2f","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.091729Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:ac917f03e9ec9d75ad3fc3193f69de0d0c9a2e7adb9150a3946fada41e030164","observation_id":"09ad89a6-caa8-41a2-a092-7ea542648abe","resolution":{"observed_at":"2026-08-06T16:21:14.953846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.935401Z","title":"Change- aware sampling and contrastive learning for satellite images","venue":null,"work_id":"24be59a6-a547-48d8-a96e-c06460d547f1","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.095791Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:1054b8deaa2b214df9b9a9752a27f70f0e114572d610fb4e7f8c70d193cb703c","observation_id":"1e0541cc-91bd-4d7b-9468-8a28d58d8341","resolution":{"observed_at":"2026-08-06T16:21:14.940148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.921977Z","title":"Seasonal contrast: Un- supervised pre-training from uncurated remote sensing data","venue":null,"work_id":"cb070eff-b9fb-40f9-8d5e-bc5934b8422b","year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.099743Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:5e9d0129ef1313870565d7ebc0b33905d3f9b2bbd6673c756d89c7ec3ede74b0","observation_id":"6c93be12-1117-4c2d-bea7-91dc0e91d321","resolution":{"observed_at":"2026-08-06T16:21:14.926004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.908361Z","title":"Towards geospatial foundation models via continual pretraining","venue":null,"work_id":"0a4c26f7-684d-415e-96f7-4ef410af8033","year":null},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.103651Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:39d06fd0b1530193c7afb890bb37b983e25b8df4b968472dc8bd53d6ae2bae5a","observation_id":"a2ef150b-54bd-4cc4-8257-e078c54b60a7","resolution":{"observed_at":"2026-08-06T16:21:14.912835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.894792Z","title":"Cmid: A unified self-supervised learning framework for remote sensing image understanding","venue":null,"work_id":"3e06ed30-be6a-4cfe-8772-710550674847","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.107780Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:50a0b6edb19dedcceba411d97cfbc00023daae2335f9fc61c9fb1aba2c85ce2d","observation_id":"e61570ff-92e2-4103-a26d-c9a3688c68a5","resolution":{"observed_at":"2026-08-06T16:21:14.899213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.881328Z","title":"Rethinking transformers pre-training for multi- spectral satellite imagery","venue":null,"work_id":"0f637864-2fb5-474a-ba87-01e702a465d4","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.112092Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:661b9a7309b79f3ae46d7ab27c88e334ebf05d0b6764044b29f7bdaac519b13f","observation_id":"b4dfc318-9253-4fca-89aa-d48e19939d8c","resolution":{"observed_at":"2026-08-06T16:21:14.885260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T16:21:14.116092Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.116092Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:9b4056254574f2cff018e366ef9dd8875de079292e360f360f4378b174de9898","observation_id":"81732ed3-46be-44f2-85d8-4ea9fbbdf42b","resolution":{"observed_at":"2026-08-06T16:21:14.116092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.867324Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"e33e5c40-4470-459d-8711-c4309f1c9618","year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.120093Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:1aa34770a3c6628c9779e56e472e45e40e3a26a9a734ddf0496a5bb2ccbf706a","observation_id":"93aab074-d092-4a07-8316-045b23f5b531","resolution":{"observed_at":"2026-08-06T16:21:14.871545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.852756Z","title":"Scale-mae: A scale-aware masked autoencoder for multiscale geospatial representation learning","venue":null,"work_id":"7bc6e9b7-195d-4799-adc0-c7d4b796404e","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.124242Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:c26471eabd66314b5871063d049bfa28feb71464f03ec951c3232c60f3afcd82","observation_id":"b515dffc-c961-456b-89d9-5e0edca325bc","resolution":{"observed_at":"2026-08-06T16:21:14.857237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.839130Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":"415ec4f2-c216-48da-b1e6-dde6d3ccd4db","year":2015},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.128510Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:e8151e6073e896988a92d572724fb7c2de5b36f6bb0550a61ab6a121dc35e848","observation_id":"03dc274b-52e3-4d3c-8ea3-6f2cd0555abb","resolution":{"observed_at":"2026-08-06T16:21:14.843383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.824910Z","title":"Scaling vision with sparse mix- ture of experts","venue":null,"work_id":"8eef3848-d02b-4647-94c7-3f86fb66010a","year":null},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.132672Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:620a4978d169c64c28757f6e0b9ed26d269240d597a9b7fd4428d43c85c64846","observation_id":"01ab2e02-aeda-4c3f-b75d-eb66b048301f","resolution":{"observed_at":"2026-08-06T16:21:14.829467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.810814Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":"9efca287-b155-441a-8213-2bc6b2870be8","year":2015},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.136812Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:a22fb648340b2e132b1a75af7bff3d87276fe1c11b33a6c6d494ce64ad503606","observation_id":"faf7bb4c-d272-4f4d-813f-a12446021e5d","resolution":{"observed_at":"2026-08-06T16:21:14.815094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.797323Z","title":null,"venue":null,"work_id":"c0527463-be85-4bbe-ba31-faeccad28b22","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.140822Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:c0e2ab872bd502a7d1358b524351fa5229c6e1ea1adf1a8782041d75e2c1f269","observation_id":"f57fe4bc-9295-435f-a994-bcdf3dc136ee","resolution":{"observed_at":"2026-08-06T16:21:14.801362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.783052Z","title":"Mixture-of- experts meets instruction tuning: A winning combination for large language models","venue":null,"work_id":"828db5f0-de27-4e4b-893e-dfd754a5ee54","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.144953Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:ec664095ec2310f4751a219fe03f6facb5d5c66701286d41b7a3c721e5d0a069","observation_id":"7f7cbdf5-df76-4621-97c0-d9fbb6115ebc","resolution":{"observed_at":"2026-08-06T16:21:14.787767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.02585","last_updated":"2016-06-08T14:52:04Z","snapshot_observed_at":"2026-08-14T21:53:39.661369Z","submitted_at":"2016-06-08T14:52:04Z","title":"Fully Convolutional Networks for Dense Semantic Labelling of High-Resolution Aerial Imagery","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.02585","snapshot_observed_at":"2026-08-06T16:21:14.149182Z","title":"Fully convolutional networks for dense se- mantic labelling of high-resolution aerial imagery","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.149182Z"},"links":{"cited_paper":"/paper/1606.02585","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:6c8fc1062e3a4319cab70ca4448cd30e0a7a4c8bcb810c21314442c2a0675593","observation_id":"de56d701-3418-428c-8871-981d489ba0a4","resolution":{"observed_at":"2026-08-06T16:21:14.149182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.769500Z","title":"Bigearthnet: A large-scale benchmark archive for remote sensing image understanding","venue":null,"work_id":"28a68f2c-33cf-4cdd-b821-102aadc2b1b9","year":2019},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.153411Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:84a85214fe1d27ad6d9bf1084d63a1def875ffa7bfc0deeb147694c99fa90616","observation_id":"a850793b-2f08-491d-8629-cbd8de27be48","resolution":{"observed_at":"2026-08-06T16:21:14.773668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.755654Z","title":null,"venue":null,"work_id":"6dda197a-eeee-426c-b081-cf2f7314afa1","year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.157461Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:3d2b3203128f4eaa6630d1510bcd0495fcfdda1e562b688975e4b911a2cb8e94","observation_id":"e11b0098-41b8-4d41-aaab-a74ec9b39b8d","resolution":{"observed_at":"2026-08-06T16:21:14.759836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.741300Z","title":"Ringmo: A remote sensing foundation model with masked image modeling","venue":null,"work_id":"bbaf9d09-39e6-4651-bfa0-bd64522dabf6","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.161865Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:98dd96cfd910a6808224eedaceb54b6a646bee9fd3dad8e671552f62c3a958df","observation_id":"2c17bfc3-f9b0-4564-98b7-66b5b9357c78","resolution":{"observed_at":"2026-08-06T16:21:14.745576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.726866Z","title":"Fair1m: A benchmark dataset for fine- grained object recognition in high-resolution remote sens- ing imagery","venue":null,"work_id":"8cbc9ac2-b1b6-4c47-9800-628f51ce6d70","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.165899Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:7a150a04aa561e2380d14f0e68a6b2e9a796ca43d99fe8a7473e767bd2ffe572","observation_id":"ed77e2ea-0f5c-479a-8958-85d11ebcceed","resolution":{"observed_at":"2026-08-06T16:21:14.731348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.712788Z","title":"Tov: The original vision model for optical re- mote sensing image understanding via self-supervised learn- ing","venue":null,"work_id":"ba75417e-86dc-4721-a17b-5a1968f3eee7","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.169988Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:b568d2b6104358e131faf5e3559100f615683290849d9b1f123d6c609bb395c3","observation_id":"08e825fe-1dbf-4bb8-8017-c1d81b195f9f","resolution":{"observed_at":"2026-08-06T16:21:14.717178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.698493Z","title":"Dynamicearthnet: Daily multi-spectral satellite dataset for semantic change segmentation","venue":null,"work_id":"59d16261-6e7b-4968-8d14-f4f6be88e9bd","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.173897Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:83fa11373b92e4a92f240be9cc415a3c05340c916860d9787cbfdd74424c691c","observation_id":"02ae285a-8200-430e-8cf5-beae0fbfff90","resolution":{"observed_at":"2026-08-06T16:21:14.702750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.684676Z","title":"Enabling country-scale land cover mapping with meter-resolution satellite imagery","venue":null,"work_id":"162651dd-2162-4ec0-a29a-cc664d28f39a","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.178010Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:240cca03b875a5f6b6228def73692288477bbddceadde5b2f357eb8d241ced82","observation_id":"ebafaf56-3042-466a-8d97-594b10612f6f","resolution":{"observed_at":"2026-08-06T16:21:14.689124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.669672Z","title":null,"venue":null,"work_id":"535fb91e-e92f-4cff-ab59-e5778c5e9db0","year":2008},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.181869Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:3fb6c883b7b44866a650051ace77a63958c2a9c09f81b38390724270a140f5ff","observation_id":"382bb0c7-6dcf-4f98-962d-556e719f9240","resolution":{"observed_at":"2026-08-06T16:21:14.675121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.655009Z","title":"Advancing plain vision transformer toward remote sensing foundation model","venue":null,"work_id":"38a982f2-4abd-4fdd-865a-bea4b0b79d4f","year":null},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.185660Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:680c149afd34bcbadbdecb00e14b90eb230f44243d01c17c57503f614af4140a","observation_id":"188e0b85-b7ea-4189-9f68-646db3b80b6c","resolution":{"observed_at":"2026-08-06T16:21:14.659725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.640032Z","title":"Scaling-up remote sensing segmentation dataset with segment anything model","venue":null,"work_id":"0bc8e52f-f391-471a-847c-c8e5853c9340","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.189539Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:11568dc981541c41a0867e6f7bc83bb875d626af1f058cf34817bbf8b03e1e00","observation_id":"b1bf28b7-9461-4208-8cee-2c74c12d6be2","resolution":{"observed_at":"2026-08-06T16:21:14.644433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05300","last_updated":"2024-07-19T13:43:13Z","snapshot_observed_at":"2026-08-16T15:01:48.890068Z","submitted_at":"2023-09-11T08:35:23Z","title":"Decoupling Common and Unique Representations for Multimodal Self-supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05300","snapshot_observed_at":"2026-08-06T16:21:14.193468Z","title":"De- cur: decoupling common & unique representations for mul- timodal self-supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.193468Z"},"links":{"cited_paper":"/paper/2309.05300","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:33ac8f78595b60536f34e1b644b5fbae3b87c16ba13c53970481bd8e7f7a4214","observation_id":"e37cc064-0617-4076-85ac-97891e56cc37","resolution":{"observed_at":"2026-08-06T16:21:14.193468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.625462Z","title":"Ssl4eo-s12: A large-scale multi-modal, multi-temporal dataset for self- supervised learning in earth observation","venue":null,"work_id":"9faf6f8c-50da-4644-a562-2b2832acf169","year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.198147Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:7ee2dff8187d4c007fa87624fa8aba6463297e9aaf9c1aa8d046b662c0debac7","observation_id":"847cb645-3126-416b-a8de-4a368e3c7204","resolution":{"observed_at":"2026-08-06T16:21:14.629993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.611082Z","title":"Zeng, Zhiyuan Yan, Jian Kang, and Xian Sun","venue":null,"work_id":"95441a06-563d-4e46-a9f6-5a70a9961ed8","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.201834Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:b5719775cab658cf094b5839a01d9e1eb29f53d5cde2d4cde16b260116501180","observation_id":"a7156116-e409-430c-906e-f893f4d21322","resolution":{"observed_at":"2026-08-06T16:21:14.615418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06670","last_updated":"2024-04-24T03:28:44Z","snapshot_observed_at":"2026-08-16T15:48:54.353594Z","submitted_at":"2023-03-12T14:24:10Z","title":"Extending global-local view alignment for self-supervised learning with remote sensing imagery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06670","snapshot_observed_at":"2026-08-06T16:21:14.205632Z","title":"Dino-mc: Self-supervised contrastive learn- ing for remote sensing imagery with multi-sized local crops","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.205632Z"},"links":{"cited_paper":"/paper/2303.06670","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:c60c6c07f16555a9c96038c23d5db699a80f649a0304c0ee2340e9f9fb22e7ee","observation_id":"b69594ab-27fb-425d-aec5-6425889607a5","resolution":{"observed_at":"2026-08-06T16:21:14.205632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.596321Z","title":"isaid: A large-scale dataset for instance segmentation in aerial images","venue":null,"work_id":"5ab63e1e-0e3d-47bd-8c78-54fc0da1c769","year":2019},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.209804Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:570f3a442560a412f62508980c2c00eddbbc87ebef6fe8db1237ccae7d9de3df","observation_id":"4fe4be08-11a0-4f69-b044-2c4a27131b10","resolution":{"observed_at":"2026-08-06T16:21:14.600438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.582360Z","title":"A compre- hensive survey of oriented object detection in remote sens- ing images","venue":null,"work_id":"c865887c-d568-4a07-b41e-7f9b2f06b98e","year":null},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.213538Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:ee31d9f1ea745bf7e340e48990e3c7c95509f8cf87bf6593cb419e8a3cbfdf92","observation_id":"deb874ef-c7db-41cf-8e04-dc656bd16c3e","resolution":{"observed_at":"2026-08-06T16:21:14.586635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.09636","last_updated":"2022-10-04T10:07:03Z","snapshot_observed_at":"2026-08-16T17:05:44.280272Z","submitted_at":"2022-04-20T17:29:48Z","title":"Residual Mixture of Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.09636","snapshot_observed_at":"2026-08-06T16:21:14.217683Z","title":"Residual mixture of ex- perts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.217683Z"},"links":{"cited_paper":"/paper/2204.09636","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:7a76cd38b2f14f1a9cbed7ca6b4783834ecf220b0b041995a01ac5feb62d9970","observation_id":"23458f6c-cae9-4d54-9e06-bb082b898981","resolution":{"observed_at":"2026-08-06T16:21:14.217683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.567800Z","title":"Aid: A benchmark data set for performance evaluation of aerial scene classification","venue":null,"work_id":"3de87eec-c9a8-4636-8590-7703ea3aaad4","year":2017},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.221973Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:70c60af2ba9e072ac2beb78eeb3571aeb54b85101003162e656d31ec7ba54b72","observation_id":"dbfda68e-cc54-40e5-a789-811a55f59915","resolution":{"observed_at":"2026-08-06T16:21:14.572079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.551905Z","title":"Unified perceptual parsing for scene understand- ing","venue":null,"work_id":"fe9942ba-75d1-49e9-8358-910c7195c0ba","year":2018},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.225924Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:ad25aa07ebe12966280420aa27b3c10bf0f2fc20702b972e241c582eceeb768a","observation_id":"7de7f1b0-f648-4b3b-9246-de0a5422d8c5","resolution":{"observed_at":"2026-08-06T16:21:14.557275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.532217Z","title":"One for all: Toward unified foundation models for earth vision","venue":null,"work_id":"44d18a13-4b3e-4dde-8ca2-f91585d21aa7","year":2024},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.229912Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:84f137b8dd39964eae25022e3dc33abab0af5ccdc21bbf47178e37f73cfc7efc","observation_id":"01788259-ecf4-4967-a2e2-fde6059b96e7","resolution":{"observed_at":"2026-08-06T16:21:14.537635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.516745Z","title":"Graph adversarial self-supervised learning","venue":null,"work_id":"0f609a51-c0b7-415b-90fe-bd72db89adf0","year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.233772Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:3295b646b6f351f3fed02cef1c22c107bbf7a14c063a1a261c315e2325d75786","observation_id":"2f74c175-536a-4da8-9af0-3051afed65ad","resolution":{"observed_at":"2026-08-06T16:21:14.521392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.501821Z","title":"A review of deep learning methods for semantic segmentation of remote sensing imagery","venue":null,"work_id":"db464595-7f52-427a-b8da-f433884ffbe8","year":2021},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.238234Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:8674fb942986584e4b9f772165a032233dee9a265d2c707daf570770284e78bc","observation_id":"5bdaba82-64f0-45c8-a9fd-7f250ef37d1c","resolution":{"observed_at":"2026-08-06T16:21:14.506315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10802","last_updated":"2023-07-20T12:10:29Z","snapshot_observed_at":"2026-08-18T15:25:55.049244Z","submitted_at":"2023-07-20T12:10:29Z","title":"Meta-Transformer: A Unified Framework for Multimodal Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10802","snapshot_observed_at":"2026-08-06T16:21:14.242806Z","title":"Meta- transformer: A unified framework for multimodal learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.242806Z"},"links":{"cited_paper":"/paper/2307.10802","citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:0334e5ccf51995f4f4d3e850afb2a02c3253080b42ae187d7e6820fb83b33e3c","observation_id":"bb67f243-f6f9-4431-a34b-1e7889d8cf85","resolution":{"observed_at":"2026-08-06T16:21:14.242806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.485903Z","title":"Uni- perceiver: Pre-training unified architecture for generic per- ception for zero-shot and few-shot tasks","venue":null,"work_id":"9fa01741-7c5b-4f24-8ffa-819d034bd828","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.246895Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:d6a4e06bb74171f38639fbd67e20087de239544e95bfcc37358eb81814ffc5d7","observation_id":"e41e3331-d3d5-46a8-a5b2-c23fba9d3aa5","resolution":{"observed_at":"2026-08-06T16:21:14.491402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:21:14.470198Z","title":"Shazeer, and William Fedus","venue":null,"work_id":"39ff1082-4006-430b-af8e-c21699c8f469","year":2022},"citing_paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T16:21:14.250669Z"},"links":{"citing_paper":"/paper/2507.13812"},"observation_digest":"sha256:9deffdc824850eef877c86204a26a585d5468f9fe9100ebf6eed3b769d180d5c","observation_id":"2f4e2310-c2da-45df-80cb-f05ae222ecef","resolution":{"observed_at":"2026-08-06T16:21:14.475522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.13812","last_updated":"2025-07-18T10:44:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T15:27:57.230569Z","submitted_at":"2025-07-18T10:44:22Z","title":"SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing"},"reference_resolution":{"displayed":86,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":61},"total_outbound_references":86},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 86 of 86 outbound references and 3 inbound Pith citation observations for arXiv:2507.13812."}