{"as_of":"2026-08-12T23:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1c2a9dffc21098240d2e4d895a436b9f868974f91266f64a01ff5b589765247","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:41:08.223342Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:33:17.633536Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T17:05:51.430203Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-08-10T20:33:17.633536Z","title":"Ccexpert: Advancing mllm capability in remote sensing change captioning with difference-aware integration and a foundational dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08114","last_updated":"2025-01-14T13:46:03Z","snapshot_observed_at":"2026-08-12T13:55:09.019217Z","submitted_at":"2025-01-14T13:46:03Z","title":"Change Captioning in Remote Sensing: Evolution to SAT-Cap -- A Single-Stage Transformer Approach","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T20:33:17.633536Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2501.08114"},"observation_digest":"sha256:174ec9400c359ae36f0869395b74ca08dacdf8d0208b041dbb19a4f32c33ab9a","observation_id":"428486d1-7cdc-4e6d-b465-2edd6a873294","resolution":{"observed_at":"2026-08-10T20:33:17.633536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-08-10T19:28:15.035643Z","title":"Ccexpert: Ad- vancing mllm capability in remote sensing change captioning with difference-aware integration and a foundational dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10075","last_updated":"2025-01-17T09:47:27Z","snapshot_observed_at":"2026-08-12T18:36:20.540281Z","submitted_at":"2025-01-17T09:47:27Z","title":"Robust Change Captioning in Remote Sensing: SECOND-CC Dataset and MModalCC Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:28:15.035643Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2501.10075"},"observation_digest":"sha256:51b4eb884e5830cff87e62f3bdf9512e482898d0b170486e5569d1ff1c978ee5","observation_id":"75f3e0be-63be-4e91-810c-a6d40836bee1","resolution":{"observed_at":"2026-08-10T19:28:15.035643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":"2411.11360","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-07-01T17:05:51.430203Z","title":"Ccexpert: Advancing mllm capability in remote sensing change captioning with difference- aware integration and a foundational dataset","venue":null,"work_id":"28b82132-2303-4ad0-a594-c168b253e97a","year":2024},"citing_paper":{"arxiv_id":"2604.14044","last_updated":"2026-04-15T16:23:05Z","snapshot_observed_at":"2026-08-11T13:09:57.123540Z","submitted_at":"2026-04-15T16:23:05Z","title":"Decoding the Delta: Unifying Remote Sensing Change Detection and Understanding with Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T13:01:26.436025Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2604.14044"},"observation_digest":"sha256:bec9acf0b62674fda676b50c3fce89f31d93fc9a08187b2b6caea63ee6b5f7f9","observation_id":"86feb4bf-979a-47cb-91d8-88aee88924d8","resolution":{"observed_at":"2026-05-10T13:05:25.185602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":"2411.11360","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-07-01T17:05:51.430203Z","title":"Ccexpert: Advancing mllm capability in remote sensing change captioning with difference- aware integration and a foundational dataset","venue":null,"work_id":"28b82132-2303-4ad0-a594-c168b253e97a","year":2024},"citing_paper":{"arxiv_id":"2604.22333","last_updated":"2026-04-24T08:05:39Z","snapshot_observed_at":"2026-08-11T17:31:55.093766Z","submitted_at":"2026-04-24T08:05:39Z","title":"ChangeQuery: Advancing Remote Sensing Change Analysis for Natural and Human-Induced Disasters from Visual Detection to Semantic Understanding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-08T12:41:38.571997Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2604.22333"},"observation_digest":"sha256:4d2638833f9819c2bad9ea950676bf50dc11eed4119a5e7a279f8ada94d01f35","observation_id":"22a273c6-00f1-4364-9448-051f673d039e","resolution":{"observed_at":"2026-05-11T19:06:09.789099Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":"2411.11360","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-07-01T17:05:51.430203Z","title":"Ccexpert: Advancing mllm capability in remote sensing change captioning with difference- aware integration and a foundational dataset","venue":null,"work_id":"28b82132-2303-4ad0-a594-c168b253e97a","year":2024},"citing_paper":{"arxiv_id":"2605.15024","last_updated":"2026-05-14T16:23:16Z","snapshot_observed_at":"2026-07-06T23:26:23.179482Z","submitted_at":"2026-05-14T16:23:16Z","title":"HiSem: Hierarchical Semantic Disentangling for Remote Sensing Image Change Captioning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-30T21:25:04.295777Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2605.15024"},"observation_digest":"sha256:801cbc121a7f7467c6ef45cf58e167592f6a38a12c92348445a2ec2ae399165b","observation_id":"96782222-4e10-408a-98bf-da1a127958c4","resolution":{"observed_at":"2026-07-01T14:25:46.730109Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":"2411.11360","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-07-01T17:05:51.430203Z","title":"Ccexpert: Advancing mllm capability in remote sensing change captioning with difference- aware integration and a foundational dataset","venue":null,"work_id":"28b82132-2303-4ad0-a594-c168b253e97a","year":2024},"citing_paper":{"arxiv_id":"2606.28266","last_updated":"2026-06-26T16:57:40Z","snapshot_observed_at":"2026-08-12T16:54:45.166709Z","submitted_at":"2026-06-26T16:57:40Z","title":"RSICCLLM: A Multimodal Large Language Model for Remote Sensing Image Change Captioning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-29T04:09:32.397341Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2606.28266"},"observation_digest":"sha256:6cc18644899ca2a2b11c14a9bf8d97bd875c48a94b05514d275c192d033e5a3d","observation_id":"911c15f5-6aa9-4475-a53d-beb835544f8c","resolution":{"observed_at":"2026-07-01T17:05:51.431636Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":"2411.11360","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-07-01T17:05:51.430203Z","title":"Ccexpert: Advancing mllm capability in remote sensing change captioning with difference- aware integration and a foundational dataset","venue":null,"work_id":"28b82132-2303-4ad0-a594-c168b253e97a","year":2024},"citing_paper":{"arxiv_id":"2606.31745","last_updated":"2026-06-30T14:37:25Z","snapshot_observed_at":"2026-08-07T15:32:19.482692Z","submitted_at":"2026-06-30T14:37:25Z","title":"JL1-CC&QA: Extending the JL1-CD Benchmark with Change Captioning and Question Answering","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-01T05:25:10.409645Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2606.31745"},"observation_digest":"sha256:dec5fe4231a611fb2de3a945a0b3233c6a2000e4bf9a7d19dc05e8ebc2c48a36","observation_id":"7966a489-e5c6-4cc7-ab3d-8f685ac154e4","resolution":{"observed_at":"2026-07-01T10:35:41.449255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11360","snapshot_observed_at":"2026-08-04T19:35:24.026097Z","title":"arXiv:2411.11360","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01856","last_updated":"2026-08-03T08:04:46Z","snapshot_observed_at":"2026-08-09T09:27:41.370973Z","submitted_at":"2026-08-03T08:04:46Z","title":"EchoChange: A Diffusion Language Model with Dual Pass Remasking for Factual Remote Sensing Disaster Change Captioning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T19:35:24.026097Z"},"links":{"cited_paper":"/paper/2411.11360","citing_paper":"/paper/2608.01856"},"observation_digest":"sha256:4730fd37c09c8bf3770ba0e0453a31c7827f8a9fe8994ddbb01cfff383d5f6f2","observation_id":"5f6ea6d7-51dd-491b-ad94-e40368149f4f","resolution":{"observed_at":"2026-08-04T19:35:24.026097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11360/citation-record","integrity":"/paper/2411.11360/integrity","json":"/paper/2411.11360/citation-record.json","paper":"/paper/2411.11360"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.14032","last_updated":"2024-07-19T05:07:41Z","snapshot_observed_at":"2026-08-12T23:18:59.056121Z","submitted_at":"2024-07-19T05:07:41Z","title":"Semantic-CC: Boosting Remote Sensing Image Change Captioning via Foundational Knowledge and Semantic Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14032","snapshot_observed_at":"2026-08-12T18:41:08.029650Z","title":"Semantic- cc: Boosting remote sensing image change captioning via foundational knowledge and semantic guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.029650Z"},"links":{"cited_paper":"/paper/2407.14032","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:612ee469259cf749756cd9f44bfcf9f5dcaeb3b3fe181785cd97bb392880150e","observation_id":"dbd69cb0-9649-4011-9c93-7789c3c8b4ef","resolution":{"observed_at":"2026-08-12T18:41:08.029650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12875","last_updated":"2024-05-21T15:44:31Z","snapshot_observed_at":"2026-07-06T18:17:21.217971Z","submitted_at":"2024-05-21T15:44:31Z","title":"Diffusion-RSCC: Diffusion Probabilistic Model for Change Captioning in Remote Sensing Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12875","snapshot_observed_at":"2026-08-12T18:41:08.033491Z","title":"Diffusion-rscc: Diffusion probabilistic model for change captioning in remote sensing images,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.033491Z"},"links":{"cited_paper":"/paper/2405.12875","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:f9f93727f0aee5f76dbf38b1ea62b6c9fbe18d91e4957274166581f5707d612c","observation_id":"da646458-4b24-4a59-a898-5fd5fbeb969e","resolution":{"observed_at":"2026-08-12T18:41:08.033491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.037227Z","title":"Rscama: Remote sensing image change captioning with state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.037227Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:be28548708971f88a817cda601262490901cdaedc67bc9dce358ecf3eaa22b85","observation_id":"656bb4a4-b5fb-4e3c-b0c6-02860c3cac1a","resolution":{"observed_at":"2026-08-12T18:41:08.037227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.040847Z","title":"Remote sensing image change captioning with dual-branch transformers: A new method and a large scale dataset,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.040847Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:a9c4c44bad194c38cd2762937083154b6b1fb8bf388b64cb95aefc9777c67163","observation_id":"c670c643-9f5f-415d-b541-9e7c96a45a6b","resolution":{"observed_at":"2026-08-12T18:41:08.040847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.782927Z","title":"Progressive scale- aware network for remote sensing image change captioning,","venue":null,"work_id":"78314904-69ed-48c7-aa8d-0ef6a78f5db2","year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.043817Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:07eb05175934c1b6f64fc89d3f6b53f0cd71760047198a1a6750764dd40e9005","observation_id":"0dbf5e09-280a-4f9e-933e-b074f072d9b1","resolution":{"observed_at":"2026-08-12T18:41:08.785604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.774811Z","title":"A decoupling paradigm with prompt learning for remote sensing image change captioning,","venue":null,"work_id":"28c8b146-c33e-4a5c-ab33-eba9a524a646","year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.047050Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:c5ebb3c04f5b5197fbf1de525dd09979dbbe2c8a748ef04489a72d0a215254a5","observation_id":"eb2b195c-0094-4049-8c0d-d64da804b8c1","resolution":{"observed_at":"2026-08-12T18:41:08.777378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.767266Z","title":"Single-stream ex- tractor network with contrastive pre-training for remote-sensing change captioning,","venue":null,"work_id":"dbcff046-f670-443a-8559-ddcdc5faa6da","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.050624Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:9886ef41007d794288a5b656adcfcdaced87a727858b81f14b16a76d320d0ba1","observation_id":"9dab8c2b-66da-4f0a-91be-9a345d6969ea","resolution":{"observed_at":"2026-08-12T18:41:08.769899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06598","last_updated":"2024-10-11T09:50:58Z","snapshot_observed_at":"2026-07-06T18:12:43.301678Z","submitted_at":"2024-05-10T16:56:53Z","title":"A Lightweight Sparse Focus Transformer for Remote Sensing Image Change Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06598","snapshot_observed_at":"2026-08-12T18:41:08.053678Z","title":"A lightweight transformer for remote sensing image change captioning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.053678Z"},"links":{"cited_paper":"/paper/2405.06598","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:b572e86e5a33bbff2522f112e03a03780b02d7d01ae87659d07e6e8a52b6652b","observation_id":"3f872874-40fe-4ef9-8729-0803950f2591","resolution":{"observed_at":"2026-08-12T18:41:08.053678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.759035Z","title":"Pixel-level change detection pseudo-label learning for remote sensing change captioning,","venue":null,"work_id":"3694dd4d-e45a-4665-8c59-52641cbb0387","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.057120Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:b09529a84f28ca6c0b4cfd2498dba65bd3212412a164eb5b1b69a9277645e246","observation_id":"e55a2d5c-4044-4e1e-abfa-17cc1c580aae","resolution":{"observed_at":"2026-08-12T18:41:08.762225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-12T18:41:08.060182Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.060182Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:9b861491f1e1249899e7b22a0d0faa193711efd4b3bbea6dc47353b7d99a9383","observation_id":"fa0c89c0-129d-4385-89ca-6f5cf013a280","resolution":{"observed_at":"2026-08-12T18:41:08.060182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.750039Z","title":"Rsprompter: Learning to prompt for remote sensing instance segmentation based on visual foundation model,","venue":null,"work_id":"dfe5a975-b082-48a8-b980-96474bcef329","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.063514Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:efd78d19c3fd81a39313d17c2d94974ef3e2080923031c19c1155b0759c46f7c","observation_id":"a62c4dca-37eb-4e1c-b0ef-1ef1678ce845","resolution":{"observed_at":"2026-08-12T18:41:08.753290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.741531Z","title":"Rsbuilding: Toward general remote sensing image building extraction and change detection with foundation model,","venue":null,"work_id":"da4c3c11-1588-4e78-81e7-7d6023104b99","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.066542Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:1dbb697657cb71112b36b85beeb31fac1804451744c6c0698538aefde1d54a80","observation_id":"c2d07baa-bfda-45bd-9ddd-403d6ef4d9b5","resolution":{"observed_at":"2026-08-12T18:41:08.744637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T18:41:08.069529Z","title":"Qwen2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.069529Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:ba5c7ca8de3b7a6c46be14abe4938423862641b91df84f76e49f5deb299bd76a","observation_id":"a8e32c3f-5b33-4832-a475-32fb55ad2ac5","resolution":{"observed_at":"2026-08-12T18:41:08.069529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T18:41:08.072869Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.072869Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:64a4f23813de90bc5b8f8661d83ab4782947a700384dd5ab78d7eed33fcf0040","observation_id":"d4c56c41-c5da-452d-a0cf-a21a32dbe047","resolution":{"observed_at":"2026-08-12T18:41:08.072869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.076023Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.076023Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:cc3e9bbd2c80a1d8a01523749bacec5069099e17bb2432d5df952711ed1d10bd","observation_id":"b34d8370-6484-4074-8b34-af738b9e7945","resolution":{"observed_at":"2026-08-12T18:41:08.076023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-12T18:41:08.079083Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and be- yond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.079083Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:523dcfd1e61372cff9623d7ebf368dbc78b0a7463ef9878448bc8a6f3b98ca55","observation_id":"abe400af-a57f-4367-8bf7-5fce3ef0fe0f","resolution":{"observed_at":"2026-08-12T18:41:08.079083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-12T18:41:08.082084Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.082084Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:2d41b0a60b0996a193aba9d75875f022bc5a935a18399e58525d88ef9521a197","observation_id":"1d3941b9-2189-40a5-8390-17dba65e4f66","resolution":{"observed_at":"2026-08-12T18:41:08.082084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.084796Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.084796Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:eb16af4541d6f9d3e140d67012da5964a42dd34aa8d789d7b05efe306f78d11c","observation_id":"d76b23f9-eaac-4e1d-9335-1b885e5e371e","resolution":{"observed_at":"2026-08-12T18:41:08.084796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-12T18:41:08.087493Z","title":"Llava-onevision: Easy visual task transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.087493Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:643a9c745ef222ebe86cb9679edcc5110b86ad308584203da8b718796a36a185","observation_id":"f4bcfffe-82b7-4f59-bb28-28fa87d3a3a6","resolution":{"observed_at":"2026-08-12T18:41:08.087493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.090274Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.090274Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:d21d346f0e1ac4c2d8f1f0782f2f8e744fddacf9fd65328ced01b676c364a449","observation_id":"34e18f2b-21e0-44d1-9476-6c47c79fd710","resolution":{"observed_at":"2026-08-12T18:41:08.090274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08585","last_updated":"2023-09-15T17:41:29Z","snapshot_observed_at":"2026-08-12T15:25:26.868862Z","submitted_at":"2023-09-15T17:41:29Z","title":"Viewpoint Integration and Registration with Vision Language Foundation Model for Image Change Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08585","snapshot_observed_at":"2026-08-12T18:41:08.092766Z","title":"Viewpoint integra- tion and registration with vision language foundation model for image change understanding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.092766Z"},"links":{"cited_paper":"/paper/2309.08585","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:06f260121c350963df92d0df0d62c75c168a40abc417a2a590f32d1a68240e6c","observation_id":"75586845-0c9e-45ad-8b41-aa01228a39d2","resolution":{"observed_at":"2026-08-12T18:41:08.092766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05645","last_updated":"2025-05-24T04:26:26Z","snapshot_observed_at":"2026-08-12T23:27:04.040633Z","submitted_at":"2024-07-08T06:14:37Z","title":"OneDiff: A Generalist Model for Image Difference Captioning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05645","snapshot_observed_at":"2026-08-12T18:41:08.095864Z","title":"Oned- iff: A generalist model for image difference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.095864Z"},"links":{"cited_paper":"/paper/2407.05645","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:ae3dd553c1b060051ebd24e8d9f25392a05b01036657cdd511a32da5c96ac35c","observation_id":"df7e641b-c560-4f2f-81eb-85933e10dabe","resolution":{"observed_at":"2026-08-12T18:41:08.095864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.718436Z","title":"Differential- perceptive and retrieval-augmented mllm for change caption- ing,","venue":null,"work_id":"57c445da-aa6f-4d6b-b4fe-47acc9d3aef7","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.099144Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:0e8bbfb081bbdadfc4efc817ef46707926ee8ac446360ab8559a406395a049c5","observation_id":"8362fd34-a7ac-4d4d-ad34-0fbdc98768f4","resolution":{"observed_at":"2026-08-12T18:41:08.721668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16261","last_updated":"2024-09-24T17:31:02Z","snapshot_observed_at":"2026-08-12T22:38:26.581631Z","submitted_at":"2024-09-24T17:31:02Z","title":"CDChat: A Large Multimodal Model for Remote Sensing Change Description","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16261","snapshot_observed_at":"2026-08-12T18:41:08.102037Z","title":"Cdchat: A large multimodal model for remote sensing change description,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.102037Z"},"links":{"cited_paper":"/paper/2409.16261","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:b299fcd9d7bc2778b23b4535b1991a1acec4a9a47d930ed310d01315c136cc3f","observation_id":"71992d24-5120-48b6-98da-739afa2c00e3","resolution":{"observed_at":"2026-08-12T18:41:08.102037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08582","last_updated":"2024-09-13T07:00:44Z","snapshot_observed_at":"2026-08-12T22:45:44.926933Z","submitted_at":"2024-09-13T07:00:44Z","title":"ChangeChat: An Interactive Model for Remote Sensing Change Analysis via Multimodal Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08582","snapshot_observed_at":"2026-08-12T18:41:08.105161Z","title":"Changechat: An interactive model for remote sensing change analysis via multimodal instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.105161Z"},"links":{"cited_paper":"/paper/2409.08582","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:3897382c4a52a53792be21b0458ff36c8d309c172041e4df5262b6b3964a7a1f","observation_id":"5f74a34a-1f6c-4ffb-b0d8-90d5e4dfd8b1","resolution":{"observed_at":"2026-08-12T18:41:08.105161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12612","last_updated":"2024-09-19T09:33:33Z","snapshot_observed_at":"2026-08-12T22:41:51.929173Z","submitted_at":"2024-09-19T09:33:33Z","title":"Enhancing Perception of Key Changes in Remote Sensing Image Change Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12612","snapshot_observed_at":"2026-08-12T18:41:08.108419Z","title":"Enhancing perception of key changes in remote sensing image change captioning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.108419Z"},"links":{"cited_paper":"/paper/2409.12612","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:6681bf21759a96fc5ba735b6e557be097e0b160ca19add013407ad47f4d2c9c5","observation_id":"f173a615-ac8b-4f76-8ed8-e93ff9e19d9e","resolution":{"observed_at":"2026-08-12T18:41:08.108419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-12T18:41:08.111877Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.111877Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:410a3331413c379d496fe2b4a62f089960d3fcfb7c899ed11e06cb0c036bfa43","observation_id":"14c0dacf-583c-4547-a596-dacc8b94728d","resolution":{"observed_at":"2026-08-12T18:41:08.111877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.114935Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.114935Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:fa71154dfa413f4cd7d24d4ac971e0ab9066a8531fabe294a83f89d8a23a3b23","observation_id":"f0aff70e-f410-4d23-a089-2b63fafe692b","resolution":{"observed_at":"2026-08-12T18:41:08.114935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.704561Z","title":"Hello gpt-4o,","venue":null,"work_id":"73b783de-f1bd-4b27-868d-3a4c09ac80ac","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.117836Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:71c2c7089e2bd36d95792b8a1141e780ef85078da79bb569106dba9572ae43ef","observation_id":"36573a16-d5a0-4c8a-b581-4fce008a122c","resolution":{"observed_at":"2026-08-12T18:41:08.707843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T18:41:08.120712Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.120712Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:0aa4237bad929d009d8ea83407888814da7e94bbc78234370eafd2871db5b5e2","observation_id":"9f2fa6e7-dd8c-4e58-adda-8e44311b63f3","resolution":{"observed_at":"2026-08-12T18:41:08.120712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.695805Z","title":"Claude-3.5,","venue":null,"work_id":"d9adf3b7-0316-460a-911b-2497fbe2f04b","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.123694Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:925f6c3316d87893295e272a130421f0d7d245f21c2106ad54b1ff6385e3ee2a","observation_id":"f8324d53-10b1-47be-bb48-82d1101f6cbd","resolution":{"observed_at":"2026-08-12T18:41:08.698849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.686387Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":"a0012e83-020f-41a9-a102-4bd98a8002e2","year":2022},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.127537Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:f45fd602b8d0b9bb7a724c681630b77725fd5fcc457f5be6b866b32347dad68e","observation_id":"c345f24c-0923-4bbb-b8b9-0501511ca0d6","resolution":{"observed_at":"2026-08-12T18:41:08.689743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-12T18:41:08.130596Z","title":"mplug-owl: Modularization empowers large language models with multimodality,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.130596Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:f00d405dad8c7a70bf7c50a746cfc760443cee7b7106bc1c71ab3e9711e702ab","observation_id":"5145f011-b232-46f5-9f84-48dbc197e420","resolution":{"observed_at":"2026-08-12T18:41:08.130596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03726","last_updated":"2025-07-28T05:33:36Z","snapshot_observed_at":"2026-07-06T15:23:52.761222Z","submitted_at":"2023-05-05T17:59:46Z","title":"Otter: A Multi-Modal Model with In-Context Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03726","snapshot_observed_at":"2026-08-12T18:41:08.134431Z","title":"Ot- ter: A multi-modal model with in-context instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.134431Z"},"links":{"cited_paper":"/paper/2305.03726","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:ff2888fa6e2ed436efa794b4f55711f8a4054b791116a8c529c9f2927540c5c0","observation_id":"15137334-05f5-4b75-9ea3-0ee58d54576e","resolution":{"observed_at":"2026-08-12T18:41:08.134431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11175","last_updated":"2023-05-25T15:02:07Z","snapshot_observed_at":"2026-07-06T15:29:20.405296Z","submitted_at":"2023-05-18T17:59:42Z","title":"VisionLLM: Large Language Model is also an Open-Ended Decoder for Vision-Centric Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11175","snapshot_observed_at":"2026-08-12T18:41:08.137777Z","title":"Visionllm: Large language model is also an open-ended decoder for vision-centric tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.137777Z"},"links":{"cited_paper":"/paper/2305.11175","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:fe19c6092d7ea9c455ac65320264242dd83e0589121254bb6a1f8b0a0ea2df55","observation_id":"572d61f9-5bd5-42ae-aa6d-732604ef6548","resolution":{"observed_at":"2026-08-12T18:41:08.137777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-12T18:41:08.141311Z","title":"Kosmos-2: Grounding multimodal large language models to the world,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.141311Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:1ef3cc75eab29e8f5ccf9a79a78db8dc2b2f17df99f8eb16b0aa717faf13b49a","observation_id":"c7669490-3d61-40ba-9ae3-33a8ac003257","resolution":{"observed_at":"2026-08-12T18:41:08.141311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14167","last_updated":"2023-05-24T02:51:37Z","snapshot_observed_at":"2026-08-06T19:11:00.161773Z","submitted_at":"2023-05-23T15:37:28Z","title":"DetGPT: Detect What You Need via Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14167","snapshot_observed_at":"2026-08-12T18:41:08.144219Z","title":"Detgpt: Detect what you need via reasoning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.144219Z"},"links":{"cited_paper":"/paper/2305.14167","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:26fb9656d67db8b539d65309c7f75fc4b74198597ed9b57464eab5654fd707d5","observation_id":"3dfb30a6-7d31-4adf-8091-bd62893314cb","resolution":{"observed_at":"2026-08-12T18:41:08.144219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-12T18:41:08.147031Z","title":"Deepseek-vl: towards real-world vision-language understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.147031Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:c01cce8e2a4f398bd83b3b1723f35df65e6be6b8351e5f32ce867135b1f9d0c7","observation_id":"393069f0-e87f-440f-9acd-830e33611733","resolution":{"observed_at":"2026-08-12T18:41:08.147031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.149609Z","title":"Intern vl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.149609Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:b5e3a485cdd732432516767687b2901bfed413dd47f492093ca815b548cee26d","observation_id":"535d7d43-83cf-4d4a-bf2e-199dbc0d6bbc","resolution":{"observed_at":"2026-08-12T18:41:08.149609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-12T18:41:08.152081Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.152081Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:6ae6a0db34cc25d53a37abad688cb6555556c328a3fe5a870262a522d013cc74","observation_id":"392b20a5-f3da-41ff-8aad-4738d063753f","resolution":{"observed_at":"2026-08-12T18:41:08.152081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-12T18:41:08.155423Z","title":"Qwen2-vl: Enhancing vision- language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.155423Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:e18fcb8b97db47de77e1a52d125b3de77c90b860d07442a1077ff7564cc3380c","observation_id":"ebd36767-876b-4fee-af74-78e8be6dfaec","resolution":{"observed_at":"2026-08-12T18:41:08.155423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.671710Z","title":"Learning to describe differences between pairs of similar images,","venue":null,"work_id":"0220b6ce-cbe3-49a6-8d62-b00f6f2cbd73","year":2018},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.158639Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:dc98d014d9c370d1ce7ee09ade1906b3ea5b7048c3cf141fd981be78c3ccc0bf","observation_id":"ec3da82b-7bbc-4af0-8237-0500f7ecf30b","resolution":{"observed_at":"2026-08-12T18:41:08.675225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.590708Z","title":"Robust change cap- tioning,","venue":null,"work_id":"bdcce307-4a66-4c75-81d2-755e40ccce29","year":2019},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.161506Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:7666fad45817479e7402a02455ecb250fe31578cd1581d801e6c8c62e57e82a6","observation_id":"7b2bb56b-70c5-4135-aa16-d1ef5d4f4408","resolution":{"observed_at":"2026-08-12T18:41:08.593742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.581338Z","title":"Viewpoint- agnostic change captioning with cycle consistency,","venue":null,"work_id":"9bd363fe-3870-48d0-acf0-f90a12878b13","year":2021},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.164612Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:24c0e0375a7db2e64c08e683e4d40c03b1e0e1b9e07467985c06fd18eade07c3","observation_id":"2dee724a-274b-4c95-963b-1499e5563d7d","resolution":{"observed_at":"2026-08-12T18:41:08.584426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.572732Z","title":"Finding it at another side: A viewpoint-adapted matching encoder for change captioning,","venue":null,"work_id":"96375696-97e7-4c9e-86d8-217c1a9186c9","year":2020},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.167572Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:bd497b2d5c98bb632c682c745f51ad2a3b7817e6f9a5704eb07709a01e456c80","observation_id":"dba555bf-c68f-4b08-86a9-8bfb499f0959","resolution":{"observed_at":"2026-08-12T18:41:08.576060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.564214Z","title":"Image change captioning by learning from an auxiliary task,","venue":null,"work_id":"21b444af-76a2-4e5c-9f5f-ae7f57101063","year":2021},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.171217Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:1c4beab7371b404d8fd76a70300f5060026a73c55387fcba2a744b6a719dbdc3","observation_id":"d5abe67e-430d-470b-8512-c405d420647e","resolution":{"observed_at":"2026-08-12T18:41:08.567139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.555200Z","title":"Visual dialog for spotting the differences between pairs of similar images,","venue":null,"work_id":"229d3e9e-9151-436a-afbe-f385ee4ef35e","year":2022},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.174118Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:5b1d7594ac4e978249d99ca6fe410583ace5ec69d27a97f7178663ee68616220","observation_id":"52d1911e-3008-45ea-a9bf-2e723d2ac4da","resolution":{"observed_at":"2026-08-12T18:41:08.558389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.546021Z","title":"Captioning changes in bi-temporal remote sensing images,","venue":null,"work_id":"2fe23f34-7404-4cd5-87fc-af3377818455","year":2021},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.177317Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:7501e1ee69fa79f6d9eec9968fb5116b8fc2c6b890e7c3ac8912b20e1c518aef","observation_id":"1c5fb16f-7ff7-4fd5-bd7a-98f766e431f5","resolution":{"observed_at":"2026-08-12T18:41:08.549179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.537147Z","title":"Change captioning: A new paradigm for multitemporal remote sensing image analysis,","venue":null,"work_id":"a14c786d-9aba-4a6f-8051-942f996929c4","year":2022},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.180174Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:e1d19327b1fa16b3246fd5fe9c0936310a4735a57aaa2ca62204af06b1f694bb","observation_id":"f5d9c033-a655-4677-86de-220c915914d6","resolution":{"observed_at":"2026-08-12T18:41:08.540222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.528991Z","title":"Changes to captions: An attentive network for remote sensing change captioning,","venue":null,"work_id":"2464824d-197c-4cd7-9def-cdfb57ba6a6a","year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.183024Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:ad97cfe287d4f82a62aeed114bfc5b84e008fdb80d6cef417fb2c2b150db2424","observation_id":"3b14daeb-6cea-458c-9cd3-393f30a1af38","resolution":{"observed_at":"2026-08-12T18:41:08.531601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.520487Z","title":"A deeply supervised attention metric-based network and an open aerial image dataset for remote sensing change detection,","venue":null,"work_id":"14a307d8-a33d-4d88-9c8b-3a0099ad24cb","year":2021},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.186097Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:02de4724e8c4289383237b28b3f0477e3d07c4be54c1610bbf503c38e57a9704","observation_id":"deda7f59-1ed5-4642-a313-0957ac477806","resolution":{"observed_at":"2026-08-12T18:41:08.523684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.188992Z","title":"A spatial-temporal attention-based method and a new dataset for remote sensing image change detection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.188992Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:15d1717d283cf30b690625ead62464d770396e13c3e7b44e12e926b9fe4519a9","observation_id":"b92bb9dc-a518-4acc-a888-78e02f59be19","resolution":{"observed_at":"2026-08-12T18:41:08.188992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T18:41:08.192197Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.192197Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:b2f0fa24995d9852ad08bec5521b03748aa5900e43de874e1b455bb43b047329","observation_id":"ebc93120-3691-4497-b30d-57de18f6fcba","resolution":{"observed_at":"2026-08-12T18:41:08.192197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.195248Z","title":"Sigmoid loss for language image pre-training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.195248Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:6b134e3d7d34799a66087ebcd5733606ce8af3ae625a89777cb2b50cbeecc3db","observation_id":"63f2d8fe-c30e-42d5-9eae-f9009aa1070d","resolution":{"observed_at":"2026-08-12T18:41:08.195248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.500969Z","title":"Robust change captioning,","venue":null,"work_id":"31b0288b-6596-4721-a401-8669b7f8bffa","year":2019},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.198391Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:8765b7ebd72a4c39fa2e3a0f88fc0abeb338dd40dc0fd162f93500d661dc213e","observation_id":"b2eb2781-458f-4b73-941e-869480bffd2b","resolution":{"observed_at":"2026-08-12T18:41:08.504048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07689","last_updated":"2019-06-19T02:49:11Z","snapshot_observed_at":"2026-08-12T03:27:16.807088Z","submitted_at":"2019-06-18T17:01:21Z","title":"Expressing Visual Relationships via Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07689","snapshot_observed_at":"2026-08-12T18:41:08.201568Z","title":"Expressing visual relationships via language,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.201568Z"},"links":{"cited_paper":"/paper/1906.07689","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:6054ca16677b8e3341504e4dcf680d3bc0bd70dc0d215a81fcede080038dc25d","observation_id":"23ee2355-02cb-4632-84a7-a3d36e87084a","resolution":{"observed_at":"2026-08-12T18:41:08.201568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.10584","last_updated":"2018-08-31T03:15:28Z","snapshot_observed_at":"2026-07-06T06:58:27.332918Z","submitted_at":"2018-08-31T03:15:28Z","title":"Learning to Describe Differences Between Pairs of Similar Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.10584","snapshot_observed_at":"2026-08-12T18:41:08.204829Z","title":"Learning to describe differences between pairs of similar images,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.204829Z"},"links":{"cited_paper":"/paper/1808.10584","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:1ac1cb1e48fa48b05338064c232ab0ad0eeaced7be7ff303131287449a7315dc","observation_id":"5b432928-5ce8-43eb-ae9a-2debe3b80fbb","resolution":{"observed_at":"2026-08-12T18:41:08.204829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.491927Z","title":"The stvchrono dataset: Towards continuous change recognition in time,","venue":null,"work_id":"294e8ff1-415d-4166-8eec-fed1dbb8809f","year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.208297Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:1aac0a7a4e13b7f429fed9c57d14856f5ec983f0bdb4afa8dedbe09826919fc4","observation_id":"2896dc81-3d10-4f5c-bfe1-6fbf7f38a16a","resolution":{"observed_at":"2026-08-12T18:41:08.495197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16772","last_updated":"2025-01-22T17:42:29Z","snapshot_observed_at":"2026-08-12T23:16:10.184738Z","submitted_at":"2024-07-23T18:10:43Z","title":"VisMin: Visual Minimal-Change Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16772","snapshot_observed_at":"2026-08-12T18:41:08.211564Z","title":"Vis- min: Visual minimal-change understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.211564Z"},"links":{"cited_paper":"/paper/2407.16772","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:6ac0b278fbd0b31b1d174b0bc7cea5f63099f92ba1bf11486ba99b84bf8a846b","observation_id":"d5fbba04-35b3-4b94-84cb-403d3db3f40b","resolution":{"observed_at":"2026-08-12T18:41:08.211564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.05368","last_updated":"2021-07-22T06:52:15Z","snapshot_observed_at":"2026-08-04T13:22:12.415118Z","submitted_at":"2021-03-09T11:36:29Z","title":"ChangeSim: Towards End-to-End Online Scene Change Detection in Industrial Indoor Environments","version":2},"cited_work":{"arxiv_id":"2103.05368","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.05368","snapshot_observed_at":"2026-08-12T18:41:08.246509Z","title":"ChangeSim: Towards End-to-End Online Scene Change Detection in Industrial Indoor Environments","venue":"cs.CV","work_id":"65af4f50-fb6a-4677-bc1d-0bdcc81d45d9","year":2021},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.215245Z"},"links":{"cited_paper":"/paper/2103.05368","citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:718fcbd7546777a0e66a822c895b83e55275e94440bb067f545e1f0e3abca118","observation_id":"6aef63a4-bb7d-479c-8bb4-83973bcf1ded","resolution":{"observed_at":"2026-08-12T18:41:08.251978Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.483872Z","title":"Semantic change detection with asymmetric siamese networks,","venue":null,"work_id":"6a3ea2b6-5bd2-47e2-8c49-cf344eef582c","year":2020},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.218305Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:b57e3cb056c6a4e7268aca5f7dabd249e69990208b3273c1fab431c49557a568","observation_id":"3374fc4f-cf6d-4d9a-8725-f949a914027a","resolution":{"observed_at":"2026-08-12T18:41:08.486661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.475803Z","title":"Robust change captioning,","venue":null,"work_id":"1746107c-805f-4674-a826-a29d6699014c","year":2019},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.220804Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:7c7aa20db03487d762db494840762ed240855bbfe3c6bab6d1d1ec1d436bf4d3","observation_id":"970cd30d-3258-49fb-b374-1176837ab23d","resolution":{"observed_at":"2026-08-12T18:41:08.478786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:41:08.466958Z","title":"Describing and localizing multiple changes with transformers,","venue":null,"work_id":"0fcac43b-c14a-41a4-b033-861a74f552fb","year":2021},"citing_paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T18:41:08.223342Z"},"links":{"citing_paper":"/paper/2411.11360"},"observation_digest":"sha256:73a2bcde69d1cf7cb46c1d1ac177df5aa3eb75d2e0a6fe159334c86b25b43a63","observation_id":"1f093cfe-020b-4c1f-9021-cae7e579bb89","resolution":{"observed_at":"2026-08-12T18:41:08.470189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.11360","last_updated":"2024-11-18T08:10:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T18:34:49.136545Z","submitted_at":"2024-11-18T08:10:49Z","title":"CCExpert: Advancing MLLM Capability in Remote Sensing Change Captioning with Difference-Aware Integration and a Foundational Dataset"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 8 inbound Pith citation observations for arXiv:2411.11360."}