Pith. sign in

Paper Citation Record · LEDGER

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

As of 22 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 4 inbound Pith citation observations for arXiv:2502.08168.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.08168 v5

Coverage vector

measured 15 of 15 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-08T10:14:30.169777Z

measured 19 of 19 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T20:09:57.312427Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

15 of 15 outbound references displayed

  • verified exact0
  • verified fuzzy2
  • unresolved13
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

0
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

Observation 2a472a32-422a-491b-89b2-53790077e6c2 · outbound

This paper cites Yi: Open Foundation Models by 01.AI.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Yi: Open Foundation Models by 01.AI

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.157778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.157778Z digest=sha256:32e7779df6bc99dab95ca494a0904d334d147b3f2498eaa165b89a667f4cbfff

Observation 3e497a2f-7f7b-4020-a666-7df7f524aa32 · outbound

This paper cites Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.118925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.118925Z digest=sha256:7bae66ee8d3b993d73b11685c95f3766fadad1f992a5f38716bfd7560f0ae275

Observation 5e269828-1cae-4364-b35a-ebeea271ab05 · outbound

This paper cites ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.130625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.130625Z digest=sha256:5fe521b9feecd98ea4b818f8fe4dc7f6d0e16134ef40320bcd92e763c013e3b6

Observation 52a68107-ddfe-483d-9ca3-3aee66aa6a90 · outbound

This paper cites RSGPT: A Remote Sensing Vision Language Model and Benchmark.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation RSGPT: A Remote Sensing Vision Language Model and Benchmark

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.133950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.133950Z digest=sha256:559b6029329903f2d615f76e30dbb1fa65005e9b51bf14f35067f2971f399d00

Observation bf1cb526-116f-46d0-a352-9599ec24b3ae · outbound

This paper cites DeepSeek-VL: Towards Real-World Vision-Language Understanding.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation DeepSeek-VL: Towards Real-World Vision-Language Understanding

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.137851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.137851Z digest=sha256:ad8561d663e886d57fc0dc129e883e64f24aab44ec3dbe5fc9e022ccdb17dbe9

Observation 67a22757-eed6-407a-85d8-4345e6b663af · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.149597Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.149597Z digest=sha256:0e2a93057f04e254524a868280827e6c9a54e4afdd47fce07c602960b0ec8477

Observation c56a11df-3d31-45c9-b7a8-d6a96129c54f · outbound

This paper cites mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.153670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.153670Z digest=sha256:958f1b5bbeb55271c13a27efbe1b8f7d65a10a736b34ef0b8f45c0d494b393a0

Observation fa0362de-a22c-4cf2-ae12-87a6f824ef4f · outbound

This paper cites RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.165818Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.165818Z digest=sha256:f26876a5cfd1974681595be9a0405dec9b21d7f97e17fb4322935d876cb3e235

Observation 45149a5f-0920-4de7-8168-ae75e20d095f · outbound

This paper cites SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.169777Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.169777Z digest=sha256:05dd20e8353577afe8f2d9990e7423fb984a0cef5889aabd257c146c1dce17db

Observation e33d852e-39d9-48f9-bb7c-82ad09036460 · outbound

This paper cites IEEE Transactions on Geoscience and Remote Sensing , 56(4):2183–2195.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation IEEE Transactions on Geoscience and Remote Sensing , 56(4):2183–2195

Reference 2017

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T10:14:30.356652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-08T10:14:30.142157Z digest=sha256:a7c451a7ae27cfdbad9766c80dd69ef52553225362016fdfe83e82aa9cc9246e

Observation 39b29885-43f7-452f-868f-85a333a61aac · outbound

This paper cites In IGARSS 2019-2019 IEEE International 10 Geoscience and Remote Sensing Symposium , pages 5901–5904.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation In IGARSS 2019-2019 IEEE International 10 Geoscience and Remote Sensing Symposium , pages 5901–5904

Reference 2019

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T10:14:30.347355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-08T10:14:30.145906Z digest=sha256:5562c423cc9420e8865bdb254144d72a5198aff652a0e743c655db0517a0c91a

Observation fd4068d0-53de-4ff9-a3e8-b0ac711a94d9 · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.126970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.126970Z digest=sha256:680a7d852f3fc711eaedad036bdfa29436b9bdcdc74c8aa29fbb7f3436a1df5f

Observation 8827234e-7c7a-47e6-abe5-f09d1766d56f · outbound

This paper cites Exploring a Fine-Grained Multiscale Method for Cross-Modal Remote Sensing Image Retrieval.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Exploring a Fine-Grained Multiscale Method for Cross-Modal Remote Sensing Image Retrieval

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.161567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.161567Z digest=sha256:bdb0610bc846825f289ff03f92a197bedc54c9fc96ad0c1f5e34a1d42f56856b

Observation 1d55e7eb-66a4-45eb-8041-384b439028c7 · outbound

This paper cites InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.122842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.122842Z digest=sha256:4cdbb9aaeb61edd762eddab7ea51146df0947e9134857d82c64ffe00fa60d844

Observation 4235af41-ea2d-4c23-a5dd-ae0a38b34f70 · outbound

This paper cites Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.114591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.114591Z digest=sha256:83f73e1a9bd35891edef9cf983610c950322110870df8b765ca4a28fc941279e

Pith citing papers

Observation c505b194-e99f-4764-b45b-f2a65179e0ee · inbound

Quantitative Comparison of Fine-Tuning Techniques for Pretrained Latent Diffusion Models in the Generation of Unseen SAR Images cites this paper.

Quantitative Comparison of Fine-Tuning Techniques for Pretrained Latent Diffusion Models in the Generation of Unseen SAR Images SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T20:09:57.312427Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:09:57.312427Z digest=sha256:c814afe48967fe6f9323e6a476c4e70bc2b1464d682f6ed4d70a5a034d9678f4

Observation 672ac5de-67e8-4e57-9766-4edc52e0a402 · inbound

SARVLM: A Vision Language Foundation Model for Semantic Understanding in SAR Imagery cites this paper.

SARVLM: A Vision Language Foundation Model for Semantic Understanding in SAR Imagery SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-21T21:00:39.059323Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-05-21T20:58:23.547519Z digest=sha256:1381018e1fcad7e5b13c8e10573b004b3e02e2206671262849ef6f32da670b5f

Observation 98bebf92-e949-40c0-b173-f2d882dee9a3 · inbound

GeoMeld: Toward Semantically Grounded Foundation Models for Remote Sensing cites this paper.

GeoMeld: Toward Semantically Grounded Foundation Models for Remote Sensing SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-11T10:56:01.624358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-05-10T15:16:55.294813Z digest=sha256:08238c764a134955f0f4cb451ecbb94ce37bf52b235b2af01a38860b69d6de23

Observation e0e82b1d-07ee-4056-93bb-e9ba319d6416 · inbound

Geospatial-Temporal Sensemaking of Remote Sensing Activity Detections with Multimodal Large Language Model cites this paper.

Geospatial-Temporal Sensemaking of Remote Sensing Activity Detections with Multimodal Large Language Model SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-05-12T04:36:21.065867Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-05-12T04:33:31.231685Z digest=sha256:86046074b6eb738238c41b77d15a3b959132930bf06b14029ceaf347a04be134