{"as_of":"2026-08-07T08:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c76bcca85d14969f856fe4f392282be71473f1efd2f01d0c5346cb822e3f9980","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:21:13.367274Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T13:48:08.135538Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:10:29.700682Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"cited_work":{"arxiv_id":"2507.05887","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05887","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ma et al","venue":null,"work_id":"325ac7bb-56ef-469e-973b-e06c936d74ca","year":2025},"citing_paper":{"arxiv_id":"2604.13654","last_updated":"2026-04-15T09:20:02Z","snapshot_observed_at":"2026-07-06T23:01:37.207817Z","submitted_at":"2026-04-15T09:20:02Z","title":"Vision-and-Language Navigation for UAVs: Progress, Challenges, and a Research Roadmap","version":1},"reference_index":143,"source":"pdf_text","source_observed_at":"2026-05-10T13:48:08.135538Z"},"links":{"cited_paper":"/paper/2507.05887","citing_paper":"/paper/2604.13654"},"observation_digest":"sha256:c9d45221b418e7a98eeb36ec0c0aa0aace03c8bc4580cc6645f9cbd15b65ea09","observation_id":"aac5cf92-72e5-47c9-8fb2-6a913f272e42","resolution":{"observed_at":"2026-05-10T14:10:29.702309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05887/citation-record","integrity":"/paper/2507.05887/integrity","json":"/paper/2507.05887/citation-record.json","paper":"/paper/2507.05887"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.040480Z","title":null,"venue":null,"work_id":"1fb3de34-baba-45a7-8747-614df4851a5f","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.143569Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c7a6d2615f46e829d37307047a7f2bb3158667795b5e8ccb6a258a121d9d0531","observation_id":"660a1f91-b8c4-4537-acd0-de3ec6c2ea49","resolution":{"observed_at":"2026-08-06T19:21:14.042976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.033051Z","title":null,"venue":null,"work_id":"06aa9165-832f-4312-85ac-70d62d83391d","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.147351Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:5a40070e3503a26b596d6d538ba16eb6c2308a2a61dcf622b8029d4c5c0540a6","observation_id":"4fe231dc-6394-4cb4-9b75-a67c53ee0d07","resolution":{"observed_at":"2026-08-06T19:21:14.035632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.026600Z","title":null,"venue":null,"work_id":"59d2a066-f134-40b2-b42f-8226b71abea9","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.150054Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0a2fec73de94a7b40a54925c2a0ff04f3995c9273ca598581253ad49deb79d46","observation_id":"08392f80-3662-40d5-913d-2dac8a2d35dd","resolution":{"observed_at":"2026-08-06T19:21:14.029030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-06T19:21:13.156391Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.156391Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:8ccfec7156fda23265e27fa03c911fc0ad5beb594b4f429ce3dbaf043f6f6fcd","observation_id":"44fe557e-3584-4247-85d4-9a04de3c28ce","resolution":{"observed_at":"2026-08-06T19:21:13.156391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.159336Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.159336Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:2f2aa0baacbf5b99e46d3a23d2e9166dfcf50673cb81fff8727f45b62fabf65d","observation_id":"990c18ce-a9d2-4dda-815c-ee0dfdd012f5","resolution":{"observed_at":"2026-08-06T19:21:13.159336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10764","last_updated":"2021-12-20T18:59:59Z","snapshot_observed_at":"2026-08-06T00:03:37.713050Z","submitted_at":"2021-12-20T18:59:59Z","title":"Mask2Former for Video Instance Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10764","snapshot_observed_at":"2026-08-06T19:21:13.164766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.164766Z"},"links":{"cited_paper":"/paper/2112.10764","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:863396fcf8de12a533b93c12b85790a23fdb4deffcc3b8be6f6191e61cf55eb4","observation_id":"87b8979b-f055-487d-850c-6ce6b719beea","resolution":{"observed_at":"2026-08-06T19:21:13.164766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.007060Z","title":null,"venue":null,"work_id":"5994a47e-a4b2-4292-b3a8-42718d04598a","year":2017},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.167299Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:93b89ff1f424407542d2adea961563934ace9c19a3093fe1d440e45fade8f11b","observation_id":"ab24024a-4d56-43e4-bd9d-10fcb4f55991","resolution":{"observed_at":"2026-08-06T19:21:14.009573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T19:21:13.169862Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.169862Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:60d71a59a6f9d22ab75108c608d1dae43081a47294aef0ebc00864bb5fa7df42","observation_id":"ca29ec16-60a7-46b2-afc1-3e144705fa15","resolution":{"observed_at":"2026-08-06T19:21:13.169862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.000330Z","title":null,"venue":null,"work_id":"bf2a7e1a-d18a-4369-8b26-fe56e91af1c2","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.172240Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:7cf87421d3dd0e99f8dad16cd6dfa2bb0fccf964f4f2d3b726a1384a87c4b90e","observation_id":"88bfb066-6fcd-4b11-8de4-449e69f7987c","resolution":{"observed_at":"2026-08-06T19:21:14.002689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.994049Z","title":null,"venue":null,"work_id":"12ba3d3b-54b7-4bbc-93a5-46b6793e4e75","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.175292Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:01d69b04b027804d382178f8dd6b08b9892efe3c9e444f7a69817471edd41a3a","observation_id":"80b4fd08-4977-473b-840e-8ea585e4cf04","resolution":{"observed_at":"2026-08-06T19:21:13.996422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.985477Z","title":null,"venue":null,"work_id":"b5e67958-5a89-4ff0-a2c4-80317fd0811d","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.177848Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:fe76a6383d0d31253d513c468e8344b64408d0887a8c51984d68aac831bfa66c","observation_id":"98abd4af-a645-40ab-8820-57cade6dc2eb","resolution":{"observed_at":"2026-08-06T19:21:13.988823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.977879Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"0e28fe08-a0b3-4450-9a8f-f9a209dfd2c8","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.181509Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4551f3a0f27f5f1cde98b8b461afe419ce09337826d45641288089765a2f2efd","observation_id":"d52040e1-bb1a-4e0d-a888-2d550952178e","resolution":{"observed_at":"2026-08-06T19:21:13.980544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.185096Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.185096Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4b4cd360f55a795565c43d147beb23edfef66fc67ee9c74cef4814c896c2371d","observation_id":"2abdf2c8-bf7f-4555-9742-abd655a3e995","resolution":{"observed_at":"2026-08-06T19:21:13.185096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15266","last_updated":"2023-07-28T02:23:35Z","snapshot_observed_at":"2026-08-05T09:46:05.780158Z","submitted_at":"2023-07-28T02:23:35Z","title":"RSGPT: A Remote Sensing Vision Language Model and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15266","snapshot_observed_at":"2026-08-06T19:21:13.189322Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.189322Z"},"links":{"cited_paper":"/paper/2307.15266","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c2decd7738df9ebedacc95bf67f7205b82f2d512aba6ebf7fdc9d559c182234c","observation_id":"4e9ac6fd-9126-4258-8354-b240f88382ba","resolution":{"observed_at":"2026-08-06T19:21:13.189322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.970455Z","title":null,"venue":null,"work_id":"aea4f612-8854-48d5-918d-79f53bfb6f24","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.192202Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:3f3f1721327c0ab7420dedbfbb51b4dcb0b57ab9f958ef78deda586a9e970d53","observation_id":"65dd5862-7f1d-4773-a7f2-cdb1b5ce76bb","resolution":{"observed_at":"2026-08-06T19:21:13.972737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.962931Z","title":null,"venue":null,"work_id":"63925813-8014-490f-b864-e97b0e706572","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.196080Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:6b9cec1ddaee8c92ffa9b0d8a5428b7132ec93434309dc5ea8fb2bea248b86b9","observation_id":"4a153714-2a6b-4318-88bc-8c7df6ae1895","resolution":{"observed_at":"2026-08-06T19:21:13.965643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.949039Z","title":null,"venue":null,"work_id":"84975a7a-4399-4717-a41d-242b0cf21dc5","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.202533Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:e09a5d37d0991df00e3f75da21242e07c7c7695f410dd643b722d3f18e1c5cae","observation_id":"992e79f1-7e66-4435-b192-acc3c1158f6c","resolution":{"observed_at":"2026-08-06T19:21:13.951410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.941160Z","title":null,"venue":null,"work_id":"1022a0e8-ec7d-48f7-b5d7-55ba7972f189","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.205579Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:29eeaeaef5e02b54ba4c184f07bf4f27d8f232d02ec0cb43e19becc0c3a92ce9","observation_id":"c5205458-7692-45d3-97ee-a1885b95543d","resolution":{"observed_at":"2026-08-06T19:21:13.943794Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.956332Z","title":"In Proceedings of the 32nd ACM International Conference on Multimedia","venue":null,"work_id":"5feb4a7f-1c04-41d8-b784-c64afb1cf05e","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.199960Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:88e4af7736700ba94eb24dfa543b770b478a03f82cf7f2331ae7308ac8ab8496","observation_id":"006fde85-9844-47a7-9dd6-4e7868bda8de","resolution":{"observed_at":"2026-08-06T19:21:13.958947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.928112Z","title":"Berg, Wan-Yen Lo, Piotr Dollár, and Ross Girshick","venue":null,"work_id":"c5c6a898-9fbb-4aaf-b879-b6a7d55593bf","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.211572Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:695499bac31e38bbbf029f696475978ea5a3c3fc4ef9f700e3c912b08cbd0c64","observation_id":"4ad76e4e-2a31-4744-a110-ea7c2bdb28c0","resolution":{"observed_at":"2026-08-06T19:21:13.930986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.919498Z","title":null,"venue":null,"work_id":"31598afa-97ad-4817-b25a-dbea51a0b2ca","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.214187Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0fb948c65f1dadb91e811a2e80721330ac820c5a66d861f260cc04b696b96764","observation_id":"15774070-291f-4f9d-ab02-93be78c868f9","resolution":{"observed_at":"2026-08-06T19:21:13.921871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.934959Z","title":null,"venue":null,"work_id":"93fd0eb3-1b5a-4174-b25b-d7a3de18a6f8","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.208979Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c6fa4f3d0ed8f531098eb38995be32ba1a1d94669a1f0c87a3a929f0a6f87de8","observation_id":"ce00f0bb-c9b0-4bf2-8141-86ad6f7f1659","resolution":{"observed_at":"2026-08-06T19:21:13.937372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.907107Z","title":null,"venue":null,"work_id":"fb59d67f-b61e-481b-946d-63597490405f","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.219540Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:ae7a38ebdb7c716200088a05f353d06293585831371c24ad8964a72e9f371c60","observation_id":"27f1a8d1-5b89-4874-9576-e14d1bcd213e","resolution":{"observed_at":"2026-08-06T19:21:13.909566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.900208Z","title":null,"venue":null,"work_id":"0c05e049-fe5d-4884-86c8-f1c9a71a15e7","year":2018},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.221724Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:fe9af51e3fbaccabe175242fba3043e1f0f4d0aa3205b960ca663de692f2538a","observation_id":"0f322e28-3588-4940-bf27-e0635665978a","resolution":{"observed_at":"2026-08-06T19:21:13.902724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.913432Z","title":null,"venue":null,"work_id":"a2c46691-b62d-4949-9e2a-4292b61160ad","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.216889Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:b79d4c9e5989076329714236f47a94d2638556a22c7e1a7b08b06af2f30bf90c","observation_id":"29daef95-d187-420b-9b1e-e046e5f19aff","resolution":{"observed_at":"2026-08-06T19:21:13.915729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.892049Z","title":null,"venue":null,"work_id":"fadfe935-92a0-4a12-9378-c38175c4002c","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.227452Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:8a222b4b7140dedcf9e0e055a499a2a1f320833789c5568f00a005ff23b3c648","observation_id":"dcd04b3d-21f1-466b-acc8-f9e011286240","resolution":{"observed_at":"2026-08-06T19:21:13.894271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.885819Z","title":null,"venue":null,"work_id":"f1a9bfa5-6706-4303-a20a-4ef124ffeb15","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.230510Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:05df2c98359da182d9e6f5d352c02c30fd3a20c81ad0d8f3dc0cd4a74e5b7b8b","observation_id":"53d83f55-59a3-440b-b250-de80680836cf","resolution":{"observed_at":"2026-08-06T19:21:13.888100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-06T19:21:13.224734Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.224734Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:9d1587441f294bde1fb2fd1356a5184f9a1b11544a234a42c17a697cfe3601eb","observation_id":"43f7876a-9f76-4b38-b789-214e274fef8a","resolution":{"observed_at":"2026-08-06T19:21:13.224734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.871859Z","title":null,"venue":null,"work_id":"aabe189f-224e-4c87-a5b0-cddc22fbde16","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.237360Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:b5ba9433b670afa52bea2b0d6ade955df1b0ef5109286754c30f3aa0c50d5ce9","observation_id":"4fee696a-b798-4960-bb9c-5f73414d7e5b","resolution":{"observed_at":"2026-08-06T19:21:13.874721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.864384Z","title":null,"venue":null,"work_id":"69cca589-87a4-4ce5-8aa0-aea6ebe91cd5","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.240906Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:e8622fa76d0049a41a5fb42b3d89b260aff717054e46b0fd57b3edf5c486b12e","observation_id":"db180228-8e0b-48f6-9043-9cb10f3825c7","resolution":{"observed_at":"2026-08-06T19:21:13.866702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.878709Z","title":null,"venue":null,"work_id":"f0b855e8-7716-4623-be6e-c1e8ffc02697","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.233699Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:2a56344fc855fda22bea9a7e3a9081ddb9f9d5428dc653094fa9499b0dfba07f","observation_id":"a739e5d1-b051-4268-b139-62245d60267e","resolution":{"observed_at":"2026-08-06T19:21:13.881102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.850264Z","title":null,"venue":null,"work_id":"a4715e7d-483a-4c62-8dbe-d9c54973cce4","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.247160Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:657fc22539acdbf081253676f6e65e7810c8d62eac087cc9096d6a0f595df3a7","observation_id":"d475d376-f5c5-4010-9617-5f26236c15d4","resolution":{"observed_at":"2026-08-06T19:21:13.852972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.842023Z","title":null,"venue":null,"work_id":"b8f45455-2829-40c1-85e1-835cea20a80f","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.249555Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:95ca5c63e42197a963293830e4ac0a2f126d4d14b67c48a400520e871459e3f5","observation_id":"f2be949d-2dc0-471e-a283-0bdba0ea3463","resolution":{"observed_at":"2026-08-06T19:21:13.845529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.857096Z","title":null,"venue":null,"work_id":"1ebf3eef-51c2-48ba-b304-38df10b60325","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.244116Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:89c94984e75e1fd688c50212ec2ed5232d636fe84bd803a170df7e85b4d2d755","observation_id":"b8310541-dd47-480d-b3bc-46426c9a4c7c","resolution":{"observed_at":"2026-08-06T19:21:13.859514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.827970Z","title":null,"venue":null,"work_id":"128e7c54-283f-4a28-bac4-d120c09d9ff0","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.255801Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0c1ad34655e48a05679dd1fa4f80aa1c4b561899bb5c42ceb025dccd5b9353ae","observation_id":"a91a7979-d10b-4013-98ae-455d104ca42f","resolution":{"observed_at":"2026-08-06T19:21:13.830301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06828","last_updated":"2025-03-13T08:16:01Z","snapshot_observed_at":"2026-08-02T08:53:20.872349Z","submitted_at":"2025-01-12T14:45:27Z","title":"GeoPix: Multi-Modal Large Language Model for Pixel-level Image Understanding in Remote Sensing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06828","snapshot_observed_at":"2026-08-06T19:21:13.258836Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.258836Z"},"links":{"cited_paper":"/paper/2501.06828","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:87be2aceeeb31227668e5c139f526e5392ca36b050a367123c75d728a59e57fc","observation_id":"834d3338-f0eb-4b07-8389-c1ba5296fd3f","resolution":{"observed_at":"2026-08-06T19:21:13.258836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.835182Z","title":null,"venue":null,"work_id":"23c2c8f8-6f3f-4415-b4cc-aa5ae4e9b31f","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.252196Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:3eb22660883e536c8b10efa308ecf1e2378886f7ea63c1433e10db1cbf919e3e","observation_id":"40fb3bb9-c16b-45ff-bc40-84bef7a2d219","resolution":{"observed_at":"2026-08-06T19:21:13.838010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20213","last_updated":"2024-12-19T13:46:40Z","snapshot_observed_at":"2026-07-06T17:53:06.519891Z","submitted_at":"2024-03-29T14:50:43Z","title":"VHM: Versatile and Honest Vision Language Model for Remote Sensing Image Analysis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20213","snapshot_observed_at":"2026-08-06T19:21:13.264931Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.264931Z"},"links":{"cited_paper":"/paper/2403.20213","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0e92c6300f38f392623f17a42da59d630434c6ce7399c05858505ec30f9d0dcd","observation_id":"f1be23c9-f869-48ca-a5ac-204dcf3a7b54","resolution":{"observed_at":"2026-08-06T19:21:13.264931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.811961Z","title":null,"venue":null,"work_id":"ef2ab88e-d874-4012-9ab7-4869047a464f","year":2016},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.269158Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:f1d4df67b5ac3921f7ae6853e7cf1a325341c16815d522becc993ef799f51601","observation_id":"e7067a98-c6f4-4be2-80c6-e26be70dceeb","resolution":{"observed_at":"2026-08-06T19:21:13.816439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.820986Z","title":null,"venue":null,"work_id":"33bde7be-3c39-4472-af11-02826a1471a3","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.261276Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:537a0a65b8d614f7ca6d4854a0b4170d12294e21c7f58356701881bd4088bd24","observation_id":"2e6f1aa2-2560-4fca-8f32-2c34d3100d7c","resolution":{"observed_at":"2026-08-06T19:21:13.823609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-06T19:21:13.276238Z","title":"Girshick, Piotr Dollár, and Christoph Feichtenhofer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.276238Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:5a52eabca2985ac193c7ca951f5017b566212e1d8a6858516372b7dbd2b6f3a7","observation_id":"e4a13af7-1844-42d6-93d6-0a6d67f9dbff","resolution":{"observed_at":"2026-08-06T19:21:13.276238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.796478Z","title":null,"venue":null,"work_id":"8ee009fb-e30e-421e-af51-7fe435efafe0","year":2016},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.278550Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:635110737d595fc547e0e771e400e02ba0e6f501fd41ff2c530d976dfca76c77","observation_id":"b6291716-896e-4d4f-8657-c0397c1553df","resolution":{"observed_at":"2026-08-06T19:21:13.799299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.803527Z","title":"Anwer, Eric Xing, Ming-Hsuan Yang, and Fahad S","venue":null,"work_id":"77dd864c-ae9d-423b-8fad-ce296c0cfc09","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.272763Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:6fc49b96d1b95985f75644d4213d02880cfc17c7c639d7173b9803a9c1687f8c","observation_id":"16e1e160-34ec-4a0a-814c-851c45e775ea","resolution":{"observed_at":"2026-08-06T19:21:13.807238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13925","last_updated":"2025-01-23T18:59:30Z","snapshot_observed_at":"2026-07-31T01:05:18.406030Z","submitted_at":"2025-01-23T18:59:30Z","title":"GeoPixel: Pixel Grounding Large Multimodal Model in Remote Sensing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13925","snapshot_observed_at":"2026-08-06T19:21:13.283891Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.283891Z"},"links":{"cited_paper":"/paper/2501.13925","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0baab64937540557c461b326cf37c9718cc4c8907bcc7f22db74ddfda2d79726","observation_id":"c50c9b8c-f911-4bfe-a4eb-2902647bee8f","resolution":{"observed_at":"2026-08-06T19:21:13.283891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06475","last_updated":"2024-02-09T15:31:01Z","snapshot_observed_at":"2026-07-06T17:28:02.037844Z","submitted_at":"2024-02-09T15:31:01Z","title":"Large Language Models for Captioning and Retrieving Remote Sensing Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06475","snapshot_observed_at":"2026-08-06T19:21:13.286686Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.286686Z"},"links":{"cited_paper":"/paper/2402.06475","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4d55afc67ecf47564da97f303588311e15daaaaf8bbbf6fa29f13541bbc3885a","observation_id":"19bc2291-6fe5-4971-a707-3496f8f536d9","resolution":{"observed_at":"2026-08-06T19:21:13.286686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.787649Z","title":null,"venue":null,"work_id":"95ee5ce8-3be1-485c-9e34-3ca9f20ead34","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.281545Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:03bfe67b51ef23a4026fb7ebba9d59daae944b2763fa54d20055e205a3a4859f","observation_id":"e5a92dce-f0ce-439b-a275-d9926c439dbd","resolution":{"observed_at":"2026-08-06T19:21:13.790384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.770979Z","title":null,"venue":null,"work_id":"d0d7596b-18d2-47ce-8f41-071cbb5fffea","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.293721Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d80892f62a953eeda7a0c9d7db3a9a6c98b046ecb13a8c0468bb5f2cf8848ce9","observation_id":"1398aaa4-0d11-40b4-9203-03d3c90883d8","resolution":{"observed_at":"2026-08-06T19:21:13.773456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.296856Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.296856Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:f93331eeffc1e1ece0fc551850d9f3eee2d0f916eac08e66f597e7089fb98a86","observation_id":"3139df1b-d263-47a1-a5ff-384402c2d462","resolution":{"observed_at":"2026-08-06T19:21:13.296856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.778729Z","title":null,"venue":null,"work_id":"89ed0859-dd3f-4ef9-8b3c-2d0ea769089c","year":2021},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.290441Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:db73f54e31f1f47d5ee532aa19959c55184495aba3379dfe9f861137d444eab6","observation_id":"cda49601-2565-4316-b30e-084aa50e37d3","resolution":{"observed_at":"2026-08-06T19:21:13.781799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.306581Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.306581Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:da991867dbf982de65066b68ead49329e631232d08674bc1a04daebca2d8ff5e","observation_id":"370315d0-0337-406d-84b2-17e478daee79","resolution":{"observed_at":"2026-08-06T19:21:13.306581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.733927Z","title":null,"venue":null,"work_id":"6df65e9e-6954-4745-94d0-cc50dbc787cb","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.313598Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:229e6a96d551dd6de286143a980b80e93791c1a8dc22ec3242da7f2a2bfcebc6","observation_id":"8aad0995-fb31-487e-9deb-d0f163877cbc","resolution":{"observed_at":"2026-08-06T19:21:13.736268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.757914Z","title":"In Thirty-Eighth AAAI Conference on Artificial Intelligence, AAAI","venue":null,"work_id":"32b46381-3cd9-4c49-ae2d-670b73ed7d1d","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.299510Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:f408ca19aa1a0e39d7237526b69ecc56e4e55b52e04f7ea9f19c3629b0f4dfe6","observation_id":"7bfbd995-2672-46e4-be7e-36c992a47117","resolution":{"observed_at":"2026-08-06T19:21:13.760628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.751245Z","title":null,"venue":null,"work_id":"b288bf29-0313-4e4a-b55b-9c003b7dfad0","year":2017},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.302774Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:20651b0330da4cd926e6ccb14187729dd47a7b3ff8a72372ad554c985c544ade","observation_id":"3dfc2135-b3a0-46b2-aa8d-ffbd32d67f99","resolution":{"observed_at":"2026-08-06T19:21:13.753754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.719903Z","title":null,"venue":null,"work_id":"0751ebf2-1760-49e7-bf92-0955ecee0571","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.324235Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4764926212d86dcb8265121d44cc5e949dcf7617a3fa2989a71d41aef1a77a9d","observation_id":"9b92d08e-69c7-4f22-838f-bead8935f663","resolution":{"observed_at":"2026-08-06T19:21:13.722769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.740643Z","title":"In 2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":"e1821ccc-57f5-4c82-9334-238531c0a9e8","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.309904Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4416c27164098ae73be43858a36a903438d9dcb706bf840d2ba773b0c9c7c30f","observation_id":"82fed69e-eb37-4aec-8a8a-8b7a7b5f4f38","resolution":{"observed_at":"2026-08-06T19:21:13.743850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.706215Z","title":null,"venue":null,"work_id":"a20f2c4a-ee46-4905-b15a-2b53dd6dfe31","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.331013Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:83a1348c634c8ec734d611ec21943ae5df650fcd488e82542d5505c46cfb6b9f","observation_id":"7e8f46a2-2ca1-4f98-b02a-ad6bc6549a17","resolution":{"observed_at":"2026-08-06T19:21:13.709036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.726771Z","title":null,"venue":null,"work_id":"653811b1-d3da-494c-a6c3-7fd99be21407","year":2019},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.317527Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:79e1ba315819e2c2b7490a51489de44ceecfc554167cc49810357f39923df20a","observation_id":"6fd21edc-21df-4105-b5c1-3c1082656000","resolution":{"observed_at":"2026-08-06T19:21:13.729445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23121","last_updated":"2025-07-14T02:03:48Z","snapshot_observed_at":"2026-08-06T21:46:18.776144Z","submitted_at":"2025-06-29T07:05:27Z","title":"CRISP-SAM2: SAM2 with Cross-Modal Interaction and Semantic Prompting for Multi-Organ Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23121","snapshot_observed_at":"2026-08-06T19:21:13.320858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.320858Z"},"links":{"cited_paper":"/paper/2506.23121","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:1ef4551d071a07f32414060395f926a230eb3607d97a711afc94d77d25b8a914","observation_id":"947e4535-6317-43b0-bf7a-605d93095ee8","resolution":{"observed_at":"2026-08-06T19:21:13.320858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.683426Z","title":null,"venue":null,"work_id":"61f502d2-0ada-4fc2-94da-8bcab311b88a","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.338926Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c325dd734ebe104824df586a6a382fc1e3e4b37428795b9a08ea8507e023aa3e","observation_id":"829b1c60-1fca-447e-9c12-208c093301a4","resolution":{"observed_at":"2026-08-06T19:21:13.687003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.712863Z","title":null,"venue":null,"work_id":"4858b2c9-1a01-4b56-b9fb-b1453e647834","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.328132Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:cbe53e918907016c705f81f8cf683029727036c1aa6c6bda1dec678498320ceb","observation_id":"e28927dd-530c-4f9c-9c5b-c6833ce5f410","resolution":{"observed_at":"2026-08-06T19:21:13.715343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.668064Z","title":null,"venue":null,"work_id":"d1cc7df0-3892-403b-a1c1-f55ecf0396cc","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.344062Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4093ec83b933591c02777e43f1d11149a15b4da8eed6a752a96f496393bd7df8","observation_id":"d7744566-f025-4dfa-81b3-0904d0c68210","resolution":{"observed_at":"2026-08-06T19:21:13.670516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.699159Z","title":null,"venue":null,"work_id":"38b04ea0-f6ca-4585-bac8-b4af2cd717ea","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.333285Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c0fafa366800dab1e0e5e31a9a3df02cf5249d8d49e8b3b01b0388b2289112f8","observation_id":"9431b12f-f9c8-47dd-86fa-3a38c5a22c9d","resolution":{"observed_at":"2026-08-06T19:21:13.701542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.690994Z","title":null,"venue":null,"work_id":"35b90e2d-165d-474e-95c6-0bf4fb16c1bf","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.336019Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:90510f610581b3013720a9ec6d68123ac9e1c5dfd1bc89e955dca0250f63f2ef","observation_id":"3ed71ea3-5fb5-4a71-b1c6-1998b732307d","resolution":{"observed_at":"2026-08-06T19:21:13.694407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.645059Z","title":null,"venue":null,"work_id":"e36b81b5-f405-43f7-a971-a3e5d6e06734","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.352176Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:583c7de8087a4c8704ff7d765f6349bb5ffc246cca56fcac51583bb59f7861ad","observation_id":"2a2c9517-0d03-4e9f-832f-d7d7d6358057","resolution":{"observed_at":"2026-08-06T19:21:13.647788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.675323Z","title":null,"venue":null,"work_id":"bd298bfd-c667-4ee3-957a-73fe73d34128","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.341312Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d9d1588dd0efb59c00bf2c31b56584ce0615fb64dfe9e8a9e0217a7220cd0497","observation_id":"879f8f35-cb9c-441a-a31c-9787a5a48bbd","resolution":{"observed_at":"2026-08-06T19:21:13.678571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.626711Z","title":null,"venue":null,"work_id":"a4af9fca-efd3-462c-9cb4-757ce53a0c69","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.357608Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:21a014c71831c2a08cd040e8991c71d2434c956ebd05386f995aa7b7c813194f","observation_id":"983bb320-2b7d-4016-9477-8a22e806b279","resolution":{"observed_at":"2026-08-06T19:21:13.630116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.660845Z","title":null,"venue":null,"work_id":"fb84a97d-903f-44e5-882e-e2b44b1f84c3","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.346772Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:9359c9cfff9b615d327d39aa3aed03d1d99eaa89dbbf81a5d36cc2b21e583930","observation_id":"e3036c18-8b06-4bb6-a620-d837be777cb0","resolution":{"observed_at":"2026-08-06T19:21:13.663937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.652624Z","title":null,"venue":null,"work_id":"2ba583eb-f4f8-4344-aa44-81f233e75388","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.349219Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:ee7c00b258b46c75f5d23f7526ead4fd49686859ea0c8fb785fa897320b05ace","observation_id":"f75c8f71-3d14-4602-b34d-e36134cb1eb5","resolution":{"observed_at":"2026-08-06T19:21:13.655643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.606553Z","title":null,"venue":null,"work_id":"a1f64a3b-8195-4cca-9afe-36b9e53fb995","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.367274Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:6aaa4e1f277b450982fa7c2824e0bcfd5871c8757384834978acf693f1853cae","observation_id":"d46e012c-9253-4086-900d-a8ac205feadd","resolution":{"observed_at":"2026-08-06T19:21:13.609896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.637216Z","title":null,"venue":null,"work_id":"b23abacc-ab9b-4921-bc5d-6f21ef4c4ace","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.355285Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:3eeae9074e315870e5cf94b6b70366e78a9d603394ff1d5078e99086970ff208","observation_id":"bfeaa366-de9b-4bc5-ab6a-480a6314524e","resolution":{"observed_at":"2026-08-06T19:21:13.639760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.616431Z","title":null,"venue":null,"work_id":"0047f162-624b-4e88-9847-a4340473b631","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.359963Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:5a98ed540336fed1705ea1306c612b30bca04d9b93d4902d50c785d3fe69bc38","observation_id":"16898cdb-0e34-4a8c-986b-6054fffe0bee","resolution":{"observed_at":"2026-08-06T19:21:13.620141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.363352Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.363352Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:8d9660d6b93163e4bc138afe3b3d73bb05c158b3a245073c4dbc0357ff5fa40c","observation_id":"2027e50a-c177-4b33-8295-ebd69acc55e2","resolution":{"observed_at":"2026-08-06T19:21:13.363352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T19:21:13.162233Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.162233Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:f8f92fba863462484d5d64ed0fd41e9a7e1d060af5b66b56a4a544c6e79f612b","observation_id":"39f31653-ee2c-44a8-bf41-da90ac5ac89a","resolution":{"observed_at":"2026-08-06T19:21:13.162233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.019041Z","title":"In Proceedings of the 32nd ACM International Conference on Multimedia","venue":null,"work_id":"b81af395-d6b1-437c-99e6-f6562d2b7eb5","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.153310Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:019e59aeeb131f1eb5bfd3aaf376be9ebf5b4224ad48550263dd72cd4c749a38","observation_id":"df890d5a-c0c6-4ccc-a69e-e136f69f0ce7","resolution":{"observed_at":"2026-08-06T19:21:14.021685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:13:34.578871Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 1 inbound Pith citation observation for arXiv:2507.05887."}