Pith. sign in

Paper Citation Record · LEDGER

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

As of 14 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 3 inbound Pith citation observations for arXiv:2502.08168.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.08168 v5

Coverage vector

measured 15 of 15 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-08T10:14:30.169777Z

measured 18 of 18 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-05-21T20:58:23.547519Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

15 of 15 outbound references displayed

  • verified exact0
  • verified fuzzy2
  • unresolved13
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

0
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

Observation 2a472a32-422a-491b-89b2-53790077e6c2 · outbound

This paper cites Yi: Open Foundation Models by 01.AI.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Yi: Open Foundation Models by 01.AI

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.157778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.157778Z digest=sha256:0d2f1099392d70be9f19f961bf58ecee9ade0fee8d552d8fff91588eedda8c17

Observation 3e497a2f-7f7b-4020-a666-7df7f524aa32 · outbound

This paper cites Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.118925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.118925Z digest=sha256:55044843d948ba8e6bceaf20debcc288b7037206244dea9dd59386b57085c786

Observation 5e269828-1cae-4364-b35a-ebeea271ab05 · outbound

This paper cites ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.130625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.130625Z digest=sha256:c462c8eeea92cf8e720e83979c97eaaf7d471e0b1a614dc6a9e78246103980ba

Observation 52a68107-ddfe-483d-9ca3-3aee66aa6a90 · outbound

This paper cites RSGPT: A Remote Sensing Vision Language Model and Benchmark.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation RSGPT: A Remote Sensing Vision Language Model and Benchmark

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.133950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.133950Z digest=sha256:a8f2a40c9565e9a002b9d299f75fb5e123d2e887c5f964e1092eeda2589983b3

Observation bf1cb526-116f-46d0-a352-9599ec24b3ae · outbound

This paper cites DeepSeek-VL: Towards Real-World Vision-Language Understanding.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation DeepSeek-VL: Towards Real-World Vision-Language Understanding

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.137851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.137851Z digest=sha256:5218d58a79999dafe528462f60d657c135fe08ed81758dd06e0456d89b86860a

Observation 67a22757-eed6-407a-85d8-4345e6b663af · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.149597Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.149597Z digest=sha256:56f3c1940b4ef50c0be759998d04e251fa3e81c9e3bca18c221e4d96e5cd8bb1

Observation c56a11df-3d31-45c9-b7a8-d6a96129c54f · outbound

This paper cites mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.153670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.153670Z digest=sha256:ebf356b97577b74b2fd89007234bbdc3f5f19d96bf5827d14eb0c93f14f86df9

Observation fa0362de-a22c-4cf2-ae12-87a6f824ef4f · outbound

This paper cites RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.165818Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.165818Z digest=sha256:f46eb3cbfb0bf80e26e93e57610d9c0f5edaa52fcce62f56455e84782e3d7566

Observation 45149a5f-0920-4de7-8168-ae75e20d095f · outbound

This paper cites SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.169777Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.169777Z digest=sha256:38fe744d161ebe2ce2a2e60334117d0c1ccd718d3384aad66bea28ef9491d4fb

Observation e33d852e-39d9-48f9-bb7c-82ad09036460 · outbound

This paper cites IEEE Transactions on Geoscience and Remote Sensing , 56(4):2183–2195.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation IEEE Transactions on Geoscience and Remote Sensing , 56(4):2183–2195

Reference 2017

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T10:14:30.356652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-08T10:14:30.142157Z digest=sha256:a2f94c7e22d401706cea66906ac4122a53cb72fd4e96ce312ff7b114b5ad0f13

Observation 39b29885-43f7-452f-868f-85a333a61aac · outbound

This paper cites In IGARSS 2019-2019 IEEE International 10 Geoscience and Remote Sensing Symposium , pages 5901–5904.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation In IGARSS 2019-2019 IEEE International 10 Geoscience and Remote Sensing Symposium , pages 5901–5904

Reference 2019

Resolution
verified fuzzy
raw_fallback, observed 2026-08-08T10:14:30.347355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-08T10:14:30.145906Z digest=sha256:4e4af20754487ef57c05316c9da2a25c185651b2c9f3b8497bda3becff9e9848

Observation fd4068d0-53de-4ff9-a3e8-b0ac711a94d9 · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.126970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.126970Z digest=sha256:7669ba14adbe78f489f8301d7a73b1762895aff2db90e797b30ccb995a59b254

Observation 8827234e-7c7a-47e6-abe5-f09d1766d56f · outbound

This paper cites Exploring a Fine-Grained Multiscale Method for Cross-Modal Remote Sensing Image Retrieval.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Exploring a Fine-Grained Multiscale Method for Cross-Modal Remote Sensing Image Retrieval

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.161567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.161567Z digest=sha256:cfc7e19e9c0c51d59aef43f9a19b8ef122d5d21fd62a460c3cdb44f74b894a6f

Observation 1d55e7eb-66a4-45eb-8041-384b439028c7 · outbound

This paper cites InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.122842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.122842Z digest=sha256:f3bb371190503ec4628298ea02692699caae1770be82db5b252438e381194150

Observation 4235af41-ea2d-4c23-a5dd-ae0a38b34f70 · outbound

This paper cites Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone.

SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-08T10:14:30.114591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:14:30.114591Z digest=sha256:0a72873b8be9ec90177675a05e6168f57d436d3cde78b1bbcd74a04faa195f2f

Pith citing papers

Observation 672ac5de-67e8-4e57-9766-4edc52e0a402 · inbound

SARVLM: A Vision Language Foundation Model for Semantic Understanding in SAR Imagery cites this paper.

SARVLM: A Vision Language Foundation Model for Semantic Understanding in SAR Imagery SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-21T21:00:39.059323Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-21T20:58:23.547519Z digest=sha256:1b8092da0a0b40f1060696495f75c9b776847d87c76e489e8923dcc61b8d829b

Observation 98bebf92-e949-40c0-b173-f2d882dee9a3 · inbound

GeoMeld: Toward Semantically Grounded Foundation Models for Remote Sensing cites this paper.

GeoMeld: Toward Semantically Grounded Foundation Models for Remote Sensing SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-11T10:56:01.624358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-10T15:16:55.294813Z digest=sha256:ab3c9264482b646f538027fe17d281290ae2b355c448a2933df4e67a8ce9ac00

Observation e0e82b1d-07ee-4056-93bb-e9ba319d6416 · inbound

Geospatial-Temporal Sensemaking of Remote Sensing Activity Detections with Multimodal Large Language Model cites this paper.

Geospatial-Temporal Sensemaking of Remote Sensing Activity Detections with Multimodal Large Language Model SARChat-Bench-2M: A Multi-Task Vision-Language Benchmark for SAR Image Interpretation

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-05-12T04:36:21.065867Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-12T04:33:31.231685Z digest=sha256:721754db0672048b2a94994a1054daf1033a37113a0d78847d17468425dc2526