Pith. sign in

Paper Citation Record · LEDGER

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation

As of 17 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2607.16327.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.16327 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T03:33:58.234123Z

measured 50 of 50 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

50 of 50 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved50
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ccb9c877-32eb-4828-97ef-69ea95b821d8 · outbound

This paper cites Deep learning tech- niques for medical image segmentation: Achievements and challenges,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Deep learning tech- niques for medical image segmentation: Achievements and challenges,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:53.916022Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:53.916022Z digest=sha256:177236b61ce5420456f1fabc202da177a246ddd5a1cab91c6c5fd34c1b5063fa

Observation 9f4b51bf-a75b-4164-a5a3-69ad9722a9a1 · outbound

This paper cites Deep learning for medical image-based cancer diagnosis,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Deep learning for medical image-based cancer diagnosis,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:53.981044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:53.981044Z digest=sha256:c5d968e1c19f933f507750e793dd92726e129e5ba5be72de6a6ca8bc4471ce49

Observation ef35072a-6485-45b3-9e25-9aac722185a2 · outbound

This paper cites U-Net: Convolutional net- works for biomedical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation U-Net: Convolutional net- works for biomedical image segmentation,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.047140Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.047140Z digest=sha256:f50a6a8c0b838c7127da39bd5842cea9327d003dbf195716700f9bfeb028ac07

Observation f3edaa6e-c1ac-43bb-bcdf-6e398ee43691 · outbound

This paper cites UNet++: A nested U-Net architecture for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation UNet++: A nested U-Net architecture for medical image segmentation,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.112810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.112810Z digest=sha256:141e3bc6ea8513cc7430331531ecbc975098b9ecf3264db01d5a48832abd25d7

Observation aa6ed495-a631-4050-8767-5aba943efc68 · outbound

This paper cites Attention U-Net: Learning Where to Look for the Pancreas.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Attention U-Net: Learning Where to Look for the Pancreas

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.180627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.180627Z digest=sha256:ddf9225e5f9fd4b61085c494373f2eea63792424525b2d58d3225b1a8a773ef3

Observation 8d064f21-0605-41a8-892d-57e17ba701ac · outbound

This paper cites Swin-Unet: Unet-like pure transformer for medical image segmenta- tion,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Swin-Unet: Unet-like pure transformer for medical image segmenta- tion,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.242270Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.242270Z digest=sha256:26f993756fb88b97f102a78189ca68ae2818c2560df6a557f714dc42c8a1e8a0

Observation 15439499-5e3e-45ba-a7c1-b4277f5f0b7c · outbound

This paper cites nnU-Net: A self-configuring method for deep learning-based biomedical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation nnU-Net: A self-configuring method for deep learning-based biomedical image segmentation,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.365978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.365978Z digest=sha256:06820a6b01f1a8b3be779610baa17ed5ef88f811cf5fb7aa4819fe924ab2d36f

Observation 38ec1d6d-3275-4a6a-a9a1-56e768c4a92e · outbound

This paper cites Vision-language models for vision tasks: A survey,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Vision-language models for vision tasks: A survey,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.439157Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.439157Z digest=sha256:eb0c89125e8f0e2d27092e1411df02f49bf7d6c97f000439d148ad96abb93507

Observation 02f9707a-dcae-4e74-8e70-1ef9c75b5b51 · outbound

This paper cites Learning transferable visual models from natural language supervision,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Learning transferable visual models from natural language supervision,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.512035Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.512035Z digest=sha256:a2920846c304677d617dcd88e6a64027372b8bc6953cb0a6c369810dd8233b65

Observation dbf4b19c-e152-4b54-ace1-91f4af370e69 · outbound

This paper cites GLoRIA: A multimodal global-local representation learning framework for label- efficient medical image recognition,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation GLoRIA: A multimodal global-local representation learning framework for label- efficient medical image recognition,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.580133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.580133Z digest=sha256:22dd633c42b8784db53c0483fd4cf244eadda1a33f8b5dc30c18f62ba5790a05

Observation b2662fa3-f2d8-479b-8e2e-dbc88add48ef · outbound

This paper cites LViT: Language meets vision transformer in medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation LViT: Language meets vision transformer in medical image segmentation,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.806210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.806210Z digest=sha256:3c729656f4976dcc0e3d9a5f382b2a982863fb86c95e2b7c6ba208e2f151dca0

Observation 4aec5cc1-f463-4c5e-8968-105fcb33c02c · outbound

This paper cites Ariadne’s thread: Using text prompts to improve segmentation of infected areas from chest x-ray images,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Ariadne’s thread: Using text prompts to improve segmentation of infected areas from chest x-ray images,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.906368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.906368Z digest=sha256:750c7aef931fb25fd0c2db727b92cf1f5d78dd1a16b00e526d6e0b2f67de4f4e

Observation db80b1ee-d729-4e65-818d-9986ad89c2f4 · outbound

This paper cites Text-guided cross-position attention for segmentation: Case of medical image,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Text-guided cross-position attention for segmentation: Case of medical image,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.985092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.985092Z digest=sha256:811c637f865fff24c15f1f46011bd77594848426abd2e909d22ec548902f1ae1

Observation f49e95bd-2331-41b7-993d-9a4c6ec1c1a0 · outbound

This paper cites Harnessing text insights with visual alignment for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Harnessing text insights with visual alignment for medical image segmentation,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.105671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.105671Z digest=sha256:5b2eaf04daac9dfa9cc3c4446381f030c5aba3005a754b99e0bf8b36850e4175

Observation 56682ac8-3629-4413-a5e8-038801929993 · outbound

This paper cites ViTexNet: Vision-text guided dynamic convolution network for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation ViTexNet: Vision-text guided dynamic convolution network for medical image segmentation,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.187965Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.187965Z digest=sha256:929348a0d87012392c4465d90bcdef123cb8fd25912a40a99ca190f70abd26ab

Observation 33998b4c-a87f-493b-a2b3-de790d01266b · outbound

This paper cites Progressive cross-scale semantic alignment for language-guided medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Progressive cross-scale semantic alignment for language-guided medical image segmentation,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.284254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.284254Z digest=sha256:17ab8ad5a7a45e143f5e081c096ea0b2fe217eaadc184739d81dba50911ea464

Observation 617ab67b-7a07-456c-a34b-625a956520de · outbound

This paper cites Making the most of text semantics to improve biomedical vision–language processing,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Making the most of text semantics to improve biomedical vision–language processing,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.353745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.353745Z digest=sha256:6f6a96267342f043a3550037e5227c75200d9b352573df30509f283591ff3d23

Observation e9c3c2af-d64f-45fe-a7d6-9727eb0a0270 · outbound

This paper cites Multimodal spatial attention module for targeting multimodal PET–CT lung tumor segmen- tation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Multimodal spatial attention module for targeting multimodal PET–CT lung tumor segmen- tation,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.420105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.420105Z digest=sha256:f5d0b83b63c5ac4749b8103908787c91f89125af870f7d86638a3f56f054107f

Observation aa00e67b-989b-4334-a743-c7adfe12a258 · outbound

This paper cites Task-driven image fusion with learnable fusion loss,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Task-driven image fusion with learnable fusion loss,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.502601Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.502601Z digest=sha256:e1d7eb41946d1f95e9f23c9c1fb8cef61b83c4bb3981df37e2cf5809e935a2e4

Observation a92034d7-f3ca-4536-bb94-63298b780d41 · outbound

This paper cites OSegNet: Operational segmentation network for COVID-19 detection using chest X-ray images,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation OSegNet: Operational segmentation network for COVID-19 detection using chest X-ray images,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.598863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.598863Z digest=sha256:0b7744f5a8f6ea54522c99cc811d6c4c424b453f7d6bbc72f38755739f375cdb

Observation 1a75f160-6048-47cb-99be-851aadb7109d · outbound

This paper cites Kvasir-SEG: A segmented polyp dataset,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Kvasir-SEG: A segmented polyp dataset,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.836541Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.836541Z digest=sha256:218bc2b0ce3813bc381e5d729595c2fb266d8404ff7dd0dadde82583e525ffc7

Observation 6714cf34-f41e-4804-81af-825014a6ad85 · outbound

This paper cites MAdapter: A better interaction between image and language for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MAdapter: A better interaction between image and language for medical image segmentation,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.919093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.919093Z digest=sha256:f570cb08b9690b84e2b3ef8f8da3334e56827f9ad52aec503df91e4e3e21a781

Observation 82f41ed1-91fb-4d90-8e37-79dafaade6a2 · outbound

This paper cites Frequency- domain multi-modal fusion for language-guided medical image seg- mentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Frequency- domain multi-modal fusion for language-guided medical image seg- mentation,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.014165Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.014165Z digest=sha256:2b71ff5fc018b5cabee4f148a3d066a858b23d1a0c8c8937ea0356143828b07c

Observation 53bf893a-44b0-42fb-87d6-a66358e35aa8 · outbound

This paper cites EviVLM: When evidential learning meets vision–language model for medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation EviVLM: When evidential learning meets vision–language model for medical image segmentation,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.073115Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.073115Z digest=sha256:487fd7bb8257cfb9c10c163806cec0ae5069a26dc7b51e3706ef4c6fac5e4fd3

Observation 5fe58786-1db7-40fb-9af0-b03b4914a82f · outbound

This paper cites Cross- modal conditioned reconstruction for language-guided medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Cross- modal conditioned reconstruction for language-guided medical image segmentation,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.155760Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.155760Z digest=sha256:15e65afc8f897c3c8b8ae4c9eba22f26417089501f647f07253a6784b857c1a7

Observation 3d63d240-409d-4c02-8355-3a0b1ddfb798 · outbound

This paper cites SGSeg: Enabling text- free inference in language-guided segmentation of chest X-rays via self-guidance,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation SGSeg: Enabling text- free inference in language-guided segmentation of chest X-rays via self-guidance,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.247291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.247291Z digest=sha256:f7a838fdbc250ee6f7f23a27ea9e3b0390922d24f18a0ac170d7a20e6959a429

Observation 7f1cce9d-9ea4-4e7e-a777-8206e2317d64 · outbound

This paper cites Alleviating Textual Reliance in Medical Language-guided Segmentation via Prototype-driven Semantic Approximation.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Alleviating Textual Reliance in Medical Language-guided Segmentation via Prototype-driven Semantic Approximation

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.305981Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.305981Z digest=sha256:84f85e354b319640e860ad133d6e979137314c70a3aa25b3ffd167d10f425fc0

Observation 184c3eab-c1d6-4fa2-ab81-0c48e4f16be0 · outbound

This paper cites Cross-aware early fusion with stage- divided vision and language transformer encoders for referring image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Cross-aware early fusion with stage- divided vision and language transformer encoders for referring image segmentation,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.402128Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.402128Z digest=sha256:e56405469968c45e02cc1bee5410fb4ff7602d23301f29de3f308eb381f6e84b

Observation 87ec8db7-05e9-4acc-8e9c-c32f1eee7932 · outbound

This paper cites CM- MaskSD: Cross-modality masked self-distillation for referring image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation CM- MaskSD: Cross-modality masked self-distillation for referring image segmentation,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.494122Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.494122Z digest=sha256:09306f49ad0c63acd504aa65e257261d2866b05e5c8e33a9babfd55ab2575d69

Observation cf30cb17-a266-4f2b-abeb-20b4128f61f7 · outbound

This paper cites Bring adaptive binding prototypes to generalized referring expression segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Bring adaptive binding prototypes to generalized referring expression segmentation,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.625962Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.625962Z digest=sha256:92cf373f8c0485717b90711cb5d20ac09874035d06eecfd72f09db10a7fb28d9

Observation 907aec0a-aa79-4011-8747-6a3d8d68b716 · outbound

This paper cites Deep learning-based clas- sification of healthy aging controls, mild cognitive impairment and alzheimer’s disease using fusion of MRI–PET imaging,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Deep learning-based clas- sification of healthy aging controls, mild cognitive impairment and alzheimer’s disease using fusion of MRI–PET imaging,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.717708Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.717708Z digest=sha256:a46939da72014098777051af9918aeb41171b0ed66463057c94857cae87ef12a

Observation 24efab2f-d1f3-4f05-8e0e-768675f6c12b · outbound

This paper cites A survey on ensemble learning under the era of deep learning,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation A survey on ensemble learning under the era of deep learning,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.809615Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.809615Z digest=sha256:d6f2b9dd61c4f9a5cb28d483d4ba3f414da2628a89bb0e38583988a555b064ea

Observation 1dc01c36-eb4d-433a-8928-dd2b7b2fd2e5 · outbound

This paper cites Advancing multi-modal beam prediction with cross-modal feature enhancement and dynamic 14 fusion mechanism,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Advancing multi-modal beam prediction with cross-modal feature enhancement and dynamic 14 fusion mechanism,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.898966Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.898966Z digest=sha256:722b2919d2dd7bd439f1e4c1cc8d08472b6820c10c9b54c0edf9292557b38c1e

Observation 5815535d-b1bf-4b44-8748-362f777a837e · outbound

This paper cites AMFuse: Add-multiply-based cross-modal fusion network for multi-spectral semantic segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation AMFuse: Add-multiply-based cross-modal fusion network for multi-spectral semantic segmentation,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:56.988194Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:56.988194Z digest=sha256:63f103b03977284e7dffa89613d416d039bc48eb82de78ba51eab1cf3d6f433f

Observation cb9b1452-7c5c-4e1b-858c-5715be6c76f8 · outbound

This paper cites ICAFusion: Iterative cross-attention guided feature fusion for multispectral object detection,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation ICAFusion: Iterative cross-attention guided feature fusion for multispectral object detection,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.069789Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.069789Z digest=sha256:327e1a04179f364f6eccec7ed7fd88ed6c82a5af74f25fbf6e57c829660ae3d3

Observation bf6c28a9-0c4b-4105-9f89-ab4300f95cc8 · outbound

This paper cites Pre-gating and contextual attention gate: A new fusion method for multi-modal data tasks,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Pre-gating and contextual attention gate: A new fusion method for multi-modal data tasks,

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.191190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.191190Z digest=sha256:aeec970f44eb07fa126fe6fc14b048bba7e29131120010cb4fdbaeba2f3c9a55

Observation 603f0933-8a78-4ddb-9fda-daf18a43b8e6 · outbound

This paper cites MsgFusion: Medical semantic guided two-branch network for multi- modal brain image fusion,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MsgFusion: Medical semantic guided two-branch network for multi- modal brain image fusion,

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.275790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.275790Z digest=sha256:4e4d8f32914de340b6bde0e5242c40f29a68332e3dc500498f715d8b97cd3a37

Observation 523a052e-91f2-4382-b937-9961366a4c32 · outbound

This paper cites MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.334363Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.334363Z digest=sha256:b0ceb1a4ba24d57aff6406ee6311346cdfd6124f686ee43788bba6859d96834a

Observation 0f425487-771b-4854-94b2-1fcb5aebe8a4 · outbound

This paper cites A simple framework for contrastive learning of visual representations,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation A simple framework for contrastive learning of visual representations,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.449823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.449823Z digest=sha256:89c1fb9e0bcb997266264393aac5d0413a8fe043fd5472ed1c5d58b81da431e6

Observation 8fff4c05-fe55-425d-a6e2-08f0cb74e0c3 · outbound

This paper cites A ConvNet for the 2020s,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation A ConvNet for the 2020s,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.511092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.511092Z digest=sha256:bc78ba8063760db5e894c67c243745e7e61568edeb12bba5203a8b8463350818

Observation f3347968-74d5-4695-8a92-421669849ac3 · outbound

This paper cites MAXIM: Multi-axis MLP for image processing,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MAXIM: Multi-axis MLP for image processing,

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.746800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.746800Z digest=sha256:a6331654b8c7b368e4e296a97f64ce34f45667313b549758e77f9fa0a34b5ef8

Observation 697b5d7a-49a1-45f5-b571-8aadd539ebcb · outbound

This paper cites Domain-specific language model pretraining for biomedical natural language processing,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Domain-specific language model pretraining for biomedical natural language processing,

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.852059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.852059Z digest=sha256:f5206e9e8e4471624b5a3ef6b29e51b54ab1ebfcbb2a84805bd71bb24094cdf0

Observation 8033f2c1-9253-42a0-be9a-26c6e8d8cd9b · outbound

This paper cites Full-resolution MLPs Empower Medical Dense Prediction.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Full-resolution MLPs Empower Medical Dense Prediction

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.687295Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.687295Z digest=sha256:6dc8bd0e0039ff7e937931689e1a0d1c2a7728be66101d08b22b95ef529fd4a8

Observation 23feed39-6b28-4a5c-86cf-782f467a7724 · outbound

This paper cites Focal loss for dense object detection,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Focal loss for dense object detection,

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.027923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.027923Z digest=sha256:2a8e8d7cb97591ceccbb9c4f425346d8e971d7376237acebe149b9130b66b2bf

Observation f70ff458-afdc-4d65-9121-9f4983c604c3 · outbound

This paper cites Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.108632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.108632Z digest=sha256:8491bbbea1bbbe6b307f32e4e71056134465fb1b5afe7e8ce514805750a72f76

Observation 69ef79aa-7110-4cb2-8a15-2e0736a3ea21 · outbound

This paper cites V-Net: Fully convolutional neural networks for volumetric medical image segmentation,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation V-Net: Fully convolutional neural networks for volumetric medical image segmentation,

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:57.926438Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:57.926438Z digest=sha256:1757d845752f6a11a2fc23398f7a14d9622aee5a892d0119e2aa1933aaab9799

Observation c63de55a-87be-4207-830c-84485f4de916 · outbound

This paper cites Segment anything in medical images,.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation Segment anything in medical images,

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.185821Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.185821Z digest=sha256:c1d47c811df7a40b74e05c7149634ba4ab5ba563a1e2ffdbcc4d752f88b2a685

Observation 2dec7d51-e1b5-41e9-8e07-6d2665f21209 · outbound

This paper cites MosMedData: Chest CT Scans With COVID-19 Related Findings Dataset.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation MosMedData: Chest CT Scans With COVID-19 Related Findings Dataset

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:55.775010Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:55.775010Z digest=sha256:7414c48d385ff2523f772299346e63fb3743bd3c0f60148ee74bf28b1da5570d

Observation 40b3cb24-6c6a-4d6c-ab2a-37cc6cee5990 · outbound

This paper cites degree and is a jointly trained Ph.D.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation degree and is a jointly trained Ph.D

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:58.234123Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:58.234123Z digest=sha256:3c99b7d17645cd2ebb16a23b335c6d19fdf4dbc2e6af17c27a58b22bbdc612af

Observation 59f09a0d-0f69-4929-aae7-d780548d24aa · outbound

This paper cites BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs.

Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-02T03:33:54.719761Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:33:54.719761Z digest=sha256:c04a7fa26d770caa1ac18b6306c9f549b8b099b6e31f325cc737ff5df0102002

Pith citing papers

No inbound Pith citation observations are available.