Pith. sign in

Paper Citation Record · LEDGER

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation

As of 9 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2607.16327.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.16327 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T03:33:58.234123Z

measured 50 of 50 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

50 of 50 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved50
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ccb9c877-32eb-4828-97ef-69ea95b821d8 · outbound

This paper cites Deep learning tech- niques for medical image segmentation: Achievements and challenges,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Deep learning tech- niques for medical image segmentation: Achievements and challenges,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:53.916022Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:53.916022Z digest=sha256:248b753c97cdbaef1ee0f94a46db42e3bd449a6a1b7b1bb4b32c8ef2925aa399

Observation 9f4b51bf-a75b-4164-a5a3-69ad9722a9a1 · outbound

This paper cites Deep learning for medical image-based cancer diagnosis,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Deep learning for medical image-based cancer diagnosis,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:53.981044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:53.981044Z digest=sha256:83cea7c943b134bdc2e03123c3137119eb1235a30a7cff4e3e9e7f32f1cbcfc2

Observation ef35072a-6485-45b3-9e25-9aac722185a2 · outbound

This paper cites U-Net: Convolutional net- works for biomedical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation U-Net: Convolutional net- works for biomedical image segmentation,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.047140Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.047140Z digest=sha256:6a6f8a8cbb47f296e5aa2273843cc22d4b93a7595c07105a43dcdf87b476aae6

Observation f3edaa6e-c1ac-43bb-bcdf-6e398ee43691 · outbound

This paper cites UNet++: A nested U-Net architecture for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation UNet++: A nested U-Net architecture for medical image segmentation,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.112810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.112810Z digest=sha256:67fb3917f33c53cdd00d97186c7f46a224b74d738adb769bdf05258fc4c77f96

Observation aa6ed495-a631-4050-8767-5aba943efc68 · outbound

This paper cites Attention U-Net: Learning Where to Look for the Pancreas.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Attention U-Net: Learning Where to Look for the Pancreas

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.180627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.180627Z digest=sha256:5e5e3fdd86b22cd0fa373c12d6d097d4560f3e0751f895ceb8e8dbea656ecd4e

Observation 8d064f21-0605-41a8-892d-57e17ba701ac · outbound

This paper cites Swin-Unet: Unet-like pure transformer for medical image segmenta- tion,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Swin-Unet: Unet-like pure transformer for medical image segmenta- tion,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.242270Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.242270Z digest=sha256:a94404017d730ebbacd86510beb8d41b8daac8b458beb19f0dc4732c189b17c2

Observation 15439499-5e3e-45ba-a7c1-b4277f5f0b7c · outbound

This paper cites nnU-Net: A self-configuring method for deep learning-based biomedical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation nnU-Net: A self-configuring method for deep learning-based biomedical image segmentation,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.365978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.365978Z digest=sha256:1b523382f335b499799f6dc098221c5ad37b559224339971cd35424cbacefd47

Observation 38ec1d6d-3275-4a6a-a9a1-56e768c4a92e · outbound

This paper cites Vision-language models for vision tasks: A survey,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Vision-language models for vision tasks: A survey,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.439157Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.439157Z digest=sha256:05d8b5fa85da525c9e6d25548dd4cc86e3c02bc296dbdc5a2367f4ffd7a5495a

Observation 02f9707a-dcae-4e74-8e70-1ef9c75b5b51 · outbound

This paper cites Learning transferable visual models from natural language supervision,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Learning transferable visual models from natural language supervision,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.512035Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.512035Z digest=sha256:ac661a1617517576b37c0a15e2b395cd38cf09eb8ce4a186f7427f4cfae82126

Observation dbf4b19c-e152-4b54-ace1-91f4af370e69 · outbound

This paper cites GLoRIA: A multimodal global-local representation learning framework for label- efficient medical image recognition,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation GLoRIA: A multimodal global-local representation learning framework for label- efficient medical image recognition,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.580133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.580133Z digest=sha256:c2828221e104ec0a6678f7eb83c8c9906c34df260d88e9971dbe0b1482d89418

Observation b2662fa3-f2d8-479b-8e2e-dbc88add48ef · outbound

This paper cites LViT: Language meets vision transformer in medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation LViT: Language meets vision transformer in medical image segmentation,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.806210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.806210Z digest=sha256:50990ada70bb353963d53dec13c308c1b67bef7096d8a780a3528e0f2c2f432e

Observation 4aec5cc1-f463-4c5e-8968-105fcb33c02c · outbound

This paper cites Ariadne’s thread: Using text prompts to improve segmentation of infected areas from chest x-ray images,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Ariadne’s thread: Using text prompts to improve segmentation of infected areas from chest x-ray images,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.906368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.906368Z digest=sha256:eebfdf6be09fd988994bc7268301ee08f9f0209891fe42edd81a7ae98b9f28c0

Observation db80b1ee-d729-4e65-818d-9986ad89c2f4 · outbound

This paper cites Text-guided cross-position attention for segmentation: Case of medical image,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Text-guided cross-position attention for segmentation: Case of medical image,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.985092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.985092Z digest=sha256:6fc7fe6edb155c3642c598c531e8264a8a4b5a9a6a9bf46ecb4cacf9749f2f9b

Observation f49e95bd-2331-41b7-993d-9a4c6ec1c1a0 · outbound

This paper cites Harnessing text insights with visual alignment for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Harnessing text insights with visual alignment for medical image segmentation,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.105671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.105671Z digest=sha256:b78b4239c89048c5be2b09889181e03eab0ff63d07e721d4a7b75f8fa8d95fef

Observation 56682ac8-3629-4413-a5e8-038801929993 · outbound

This paper cites ViTexNet: Vision-text guided dynamic convolution network for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation ViTexNet: Vision-text guided dynamic convolution network for medical image segmentation,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.187965Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.187965Z digest=sha256:a44271b8b41542eeaaabd45809415050c041bb7c3b393cec6ce4d442de7e430f

Observation 33998b4c-a87f-493b-a2b3-de790d01266b · outbound

This paper cites Progressive cross-scale semantic alignment for language-guided medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Progressive cross-scale semantic alignment for language-guided medical image segmentation,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.284254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.284254Z digest=sha256:a317254836a81b1cbdcfe5e4f2a9241491075fcc355cf717d27145d167595f9f

Observation 617ab67b-7a07-456c-a34b-625a956520de · outbound

This paper cites Making the most of text semantics to improve biomedical vision–language processing,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Making the most of text semantics to improve biomedical vision–language processing,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.353745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.353745Z digest=sha256:f253c1d567f035ddba36007f41e3193d4646680ba7e03b7bca49ab14078589f1

Observation e9c3c2af-d64f-45fe-a7d6-9727eb0a0270 · outbound

This paper cites Multimodal spatial attention module for targeting multimodal PET–CT lung tumor segmen- tation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Multimodal spatial attention module for targeting multimodal PET–CT lung tumor segmen- tation,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.420105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.420105Z digest=sha256:d3bc61cf44c850c0d51c600cc3e66a86fad249d29adb66aa4346578810956b66

Observation aa00e67b-989b-4334-a743-c7adfe12a258 · outbound

This paper cites Task-driven image fusion with learnable fusion loss,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Task-driven image fusion with learnable fusion loss,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.502601Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.502601Z digest=sha256:e1d0dae3808b55a05a76494bcb484670602a596d1155369affcb922bf96df1b9

Observation a92034d7-f3ca-4536-bb94-63298b780d41 · outbound

This paper cites OSegNet: Operational segmentation network for COVID-19 detection using chest X-ray images,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation OSegNet: Operational segmentation network for COVID-19 detection using chest X-ray images,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.598863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.598863Z digest=sha256:8c01cf260148c055b046bd13f9d203c96cd8a48057140478152a614192a8bd8f

Observation 1a75f160-6048-47cb-99be-851aadb7109d · outbound

This paper cites Kvasir-SEG: A segmented polyp dataset,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Kvasir-SEG: A segmented polyp dataset,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.836541Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.836541Z digest=sha256:8eb1e7ebacf04dfd093290972cb2a28cc1d0ae2ef02552e93d02298bdc822802

Observation 6714cf34-f41e-4804-81af-825014a6ad85 · outbound

This paper cites MAdapter: A better interaction between image and language for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MAdapter: A better interaction between image and language for medical image segmentation,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.919093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.919093Z digest=sha256:45281c82f4ba415e50828c595661f5e04f24ae85d33b9e80b47efd535da96ab9

Observation 82f41ed1-91fb-4d90-8e37-79dafaade6a2 · outbound

This paper cites Frequency- domain multi-modal fusion for language-guided medical image seg- mentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Frequency- domain multi-modal fusion for language-guided medical image seg- mentation,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.014165Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.014165Z digest=sha256:1f5dd65096ed6574c402b0245f81e9d65d6ce1e3b26839e7afe9cbc377feb2b7

Observation 53bf893a-44b0-42fb-87d6-a66358e35aa8 · outbound

This paper cites EviVLM: When evidential learning meets vision–language model for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation EviVLM: When evidential learning meets vision–language model for medical image segmentation,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.073115Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.073115Z digest=sha256:db7a119855ce98bba19b7543804a4159324050cf117833c30f000f6453f38aac

Observation 5fe58786-1db7-40fb-9af0-b03b4914a82f · outbound

This paper cites Cross- modal conditioned reconstruction for language-guided medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Cross- modal conditioned reconstruction for language-guided medical image segmentation,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.155760Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.155760Z digest=sha256:8d2991f99e9ee0472c12c8a40a2a67b577a88806393d2d058606e6825f8aa969

Observation 3d63d240-409d-4c02-8355-3a0b1ddfb798 · outbound

This paper cites SGSeg: Enabling text- free inference in language-guided segmentation of chest X-rays via self-guidance,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation SGSeg: Enabling text- free inference in language-guided segmentation of chest X-rays via self-guidance,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.247291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.247291Z digest=sha256:bddf61758b7138dcc9ddc06190ac381152e7ba807ac6199e67f18c16de8bc583

Observation 7f1cce9d-9ea4-4e7e-a777-8206e2317d64 · outbound

This paper cites Alleviating Textual Reliance in Medical Language-guided Segmentation via Prototype-driven Semantic Approximation.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Alleviating Textual Reliance in Medical Language-guided Segmentation via Prototype-driven Semantic Approximation

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.305981Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.305981Z digest=sha256:a2bac9580d477f33ada93bf21d0b235260de38a433831e2aa8ab3e0b136d8481

Observation 184c3eab-c1d6-4fa2-ab81-0c48e4f16be0 · outbound

This paper cites Cross-aware early fusion with stage- divided vision and language transformer encoders for referring image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Cross-aware early fusion with stage- divided vision and language transformer encoders for referring image segmentation,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.402128Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.402128Z digest=sha256:0ba713c09cf5545d9a2625f74aaa07faa5271bf79b01475d6e54ce41acf7c444

Observation 87ec8db7-05e9-4acc-8e9c-c32f1eee7932 · outbound

This paper cites CM- MaskSD: Cross-modality masked self-distillation for referring image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation CM- MaskSD: Cross-modality masked self-distillation for referring image segmentation,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.494122Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.494122Z digest=sha256:a844bdc837438672c18ccd6f29ab021b9ab7ec95aaea00479d76d46b1a60789d

Observation cf30cb17-a266-4f2b-abeb-20b4128f61f7 · outbound

This paper cites Bring adaptive binding prototypes to generalized referring expression segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Bring adaptive binding prototypes to generalized referring expression segmentation,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.625962Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.625962Z digest=sha256:23fb5827deab9ac336fab3ad57292b4261ea0c967786acc315e5dbeff09f6539

Observation 907aec0a-aa79-4011-8747-6a3d8d68b716 · outbound

This paper cites Deep learning-based clas- sification of healthy aging controls, mild cognitive impairment and alzheimer’s disease using fusion of MRI–PET imaging,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Deep learning-based clas- sification of healthy aging controls, mild cognitive impairment and alzheimer’s disease using fusion of MRI–PET imaging,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.717708Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.717708Z digest=sha256:ac0d94565420ae9ca34017fc93bb4d3276200f8f5efe4e7ffae2ab105f034dfe

Observation 24efab2f-d1f3-4f05-8e0e-768675f6c12b · outbound

This paper cites A survey on ensemble learning under the era of deep learning,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation A survey on ensemble learning under the era of deep learning,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.809615Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.809615Z digest=sha256:d24fc9cf534d332c1653ebf474083f9cc93188d74eb36e39bd3010a2c2e9613d

Observation 1dc01c36-eb4d-433a-8928-dd2b7b2fd2e5 · outbound

This paper cites Advancing multi-modal beam prediction with cross-modal feature enhancement and dynamic 14 fusion mechanism,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Advancing multi-modal beam prediction with cross-modal feature enhancement and dynamic 14 fusion mechanism,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.898966Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.898966Z digest=sha256:c49fcc7aae7b83c382e9cb8d30bb4c93dbd8b3e04978c622a8913058c07e8ee3

Observation 5815535d-b1bf-4b44-8748-362f777a837e · outbound

This paper cites AMFuse: Add-multiply-based cross-modal fusion network for multi-spectral semantic segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation AMFuse: Add-multiply-based cross-modal fusion network for multi-spectral semantic segmentation,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.988194Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.988194Z digest=sha256:165be709584c75e7224111c4dd51a28ba90c6d21e9e831e3a8a4aa473351f7b8

Observation cb9b1452-7c5c-4e1b-858c-5715be6c76f8 · outbound

This paper cites ICAFusion: Iterative cross-attention guided feature fusion for multispectral object detection,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation ICAFusion: Iterative cross-attention guided feature fusion for multispectral object detection,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.069789Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.069789Z digest=sha256:005c478fbc9374e661e22c4f1263c4c5c69004bbdfdfc43b2c009469251ed581

Observation bf6c28a9-0c4b-4105-9f89-ab4300f95cc8 · outbound

This paper cites Pre-gating and contextual attention gate: A new fusion method for multi-modal data tasks,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Pre-gating and contextual attention gate: A new fusion method for multi-modal data tasks,

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.191190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.191190Z digest=sha256:06df97fcf25d899c973f5602e05905ab6b9e8c585aca3132182b318348e4dcd2

Observation 603f0933-8a78-4ddb-9fda-daf18a43b8e6 · outbound

This paper cites MsgFusion: Medical semantic guided two-branch network for multi- modal brain image fusion,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MsgFusion: Medical semantic guided two-branch network for multi- modal brain image fusion,

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.275790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.275790Z digest=sha256:581ac85eeee4d6952de98173dd8fec37f2fdcd4eee05e89040f74196995e9cab

Observation 523a052e-91f2-4382-b937-9961366a4c32 · outbound

This paper cites MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.334363Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.334363Z digest=sha256:38b917d5d79b139a130f5b6ce126b9ee6a2ec8f09adec0509c7de81086bc8248

Observation 0f425487-771b-4854-94b2-1fcb5aebe8a4 · outbound

This paper cites A simple framework for contrastive learning of visual representations,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation A simple framework for contrastive learning of visual representations,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.449823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.449823Z digest=sha256:2458b80f6957dd2676b063c6d51f6bf515e5fcc700ba667c830d9be756c18a01

Observation 8fff4c05-fe55-425d-a6e2-08f0cb74e0c3 · outbound

This paper cites A ConvNet for the 2020s,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation A ConvNet for the 2020s,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.511092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.511092Z digest=sha256:6153169619b94fb11f4d6df32b385f400698a6277f4e0b674a7c2b51dd7c551a

Observation f3347968-74d5-4695-8a92-421669849ac3 · outbound

This paper cites MAXIM: Multi-axis MLP for image processing,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MAXIM: Multi-axis MLP for image processing,

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.746800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.746800Z digest=sha256:d659b6761fc068ca0986fb6cd2a1a0e49411f76cd354f08a49ff0665bc4eaa55

Observation 697b5d7a-49a1-45f5-b571-8aadd539ebcb · outbound

This paper cites Domain-specific language model pretraining for biomedical natural language processing,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Domain-specific language model pretraining for biomedical natural language processing,

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.852059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.852059Z digest=sha256:4dca8e9b1cf517caf315c5befacae18ef902c57e646c3bae778cbc7bcf94a43f

Observation 8033f2c1-9253-42a0-be9a-26c6e8d8cd9b · outbound

This paper cites Full-resolution MLPs Empower Medical Dense Prediction.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Full-resolution MLPs Empower Medical Dense Prediction

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.687295Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.687295Z digest=sha256:c7c12b7ff479473828a9b417c7a0f7143a2bae89e45b0bfc7b8932349bf3649f

Observation 23feed39-6b28-4a5c-86cf-782f467a7724 · outbound

This paper cites Focal loss for dense object detection,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Focal loss for dense object detection,

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.027923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.027923Z digest=sha256:7a4c5d610ba728b3ba3a03a30152d1231f046d19b97f9c3c8b84c9f6d1e4732c

Observation f70ff458-afdc-4d65-9121-9f4983c604c3 · outbound

This paper cites Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.108632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.108632Z digest=sha256:129b7a432b724c87c21d1e69064512a2e5a20b1877896568d0a5b64e11f46d39

Observation 69ef79aa-7110-4cb2-8a15-2e0736a3ea21 · outbound

This paper cites V-Net: Fully convolutional neural networks for volumetric medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation V-Net: Fully convolutional neural networks for volumetric medical image segmentation,

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.926438Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.926438Z digest=sha256:2b629c694bbb39941b9157f3aadb69e402ee0f646b082c1c6cd1ace715b46814

Observation c63de55a-87be-4207-830c-84485f4de916 · outbound

This paper cites Segment anything in medical images,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Segment anything in medical images,

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.185821Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.185821Z digest=sha256:2b20e73bef3ae273acbbd22ca6475366d548cda20e8e9312860d8e857d83bd41

Observation 2dec7d51-e1b5-41e9-8e07-6d2665f21209 · outbound

This paper cites MosMedData: Chest CT Scans With COVID-19 Related Findings Dataset.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MosMedData: Chest CT Scans With COVID-19 Related Findings Dataset

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.775010Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.775010Z digest=sha256:c1daf92d8e457d43717f999c1ae71b22087fa2172461fd9151ba1b3799777abc

Observation 40b3cb24-6c6a-4d6c-ab2a-37cc6cee5990 · outbound

This paper cites degree and is a jointly trained Ph.D.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation degree and is a jointly trained Ph.D

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.234123Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.234123Z digest=sha256:6dde43855663ba59fb97548b87ea5b9358dda19aaa418f382f602b4acaaa4005

Observation 59f09a0d-0f69-4929-aae7-d780548d24aa · outbound

This paper cites BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.719761Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.719761Z digest=sha256:2b492e34ff229ae4bb7e12cf5ea8dc8b4be1f10da3630307ca3227ba0c42a15b

Pith citing papers

No inbound Pith citation observations are available.