{"as_of":"2026-08-13T18:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:214a8825daad5d01b3a99dcb975c6a479a4faa09b80ae6fdff909aa79dde6ddc","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:28:41.980645Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08570/citation-record","integrity":"/paper/2509.08570/integrity","json":"/paper/2509.08570/citation-record.json","paper":"/paper/2509.08570"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.083292Z","title":"A survey of unsupervised deep domain adaptation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.083292Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:ef53dea8e9c3d5d77909786f321062bf85ecf60901217e172143e9023ceb8691","observation_id":"fb92747d-1b98-4324-90db-40f3a5774590","resolution":{"observed_at":"2026-08-04T20:28:37.083292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.210212Z","title":"A comprehensive survey on source-free domain adaptation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.210212Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:639fa86ec7bb0effdf62666aead509932ac27c25fb000a135b7bb841d6157330","observation_id":"ea9e7f68-f401-4e59-bd1d-7118b4f85780","resolution":{"observed_at":"2026-08-04T20:28:37.210212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.372868Z","title":"Domaingeneralizationthroughmeta- learning: a survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.372868Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:4af26daa9c53b0c55324a665b82555a0fb766f987b6ee59e0edfd1b1ce21529f","observation_id":"e8f67e55-6bf0-43e9-ad81-48a61b95e5c9","resolution":{"observed_at":"2026-08-04T20:28:37.372868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.553730Z","title":"Open domain gen- eralization with domain-augmented meta-learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.553730Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:277139e0885f53f09502c827735ca8b7a2c6bd9f3c4c2c09af9c14e5b67fbdb9","observation_id":"d6355fa5-4b16-4f59-b13e-d32356a4d589","resolution":{"observed_at":"2026-08-04T20:28:37.553730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.702825Z","title":"Reducing domain gap in frequency and spatial domain for cross-modality domain adaptation on medical image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.702825Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:dc542f5b3ab24a2050614774dfd34535be081ae7ef09adb6863884981b51bcdb","observation_id":"6ea44e3f-17de-4d10-9c59-d08bfd9cea35","resolution":{"observed_at":"2026-08-04T20:28:37.702825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.865345Z","title":"Domain generaliza- tion: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.865345Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:6a197a520cea73bc0b3e9c1a4f342736bf4db6de451170e5943f255128ead042","observation_id":"c945286a-b291-4f9b-a1b2-b4b26acd75c0","resolution":{"observed_at":"2026-08-04T20:28:37.865345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:37.978374Z","title":"Adversarial consistency for single domain generalization in medical image segmentation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:37.978374Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:4cc8d588858cd2dee744f62389645e0d0c1b6ec9462b65f35bb9f84ccd8ab7fb","observation_id":"3f265cb4-f254-4acf-ac9d-e5bce079727e","resolution":{"observed_at":"2026-08-04T20:28:37.978374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.051036Z","title":"Structure-aware single-source gen- eralization with pixel-level disentanglement for joint optic disc and cup segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.051036Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:251d01f49abf1b8b3c1bdd5d87bcd380c06f8e06ff74a21a90a3b320bff318d3","observation_id":"193d9b5b-5bc5-468d-a211-7f0f1271bec6","resolution":{"observed_at":"2026-08-04T20:28:38.051036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.191160Z","title":"Multi- receptive field feature disentanglement with distance-aware gaussian brightness augmentation for single-source domain generalization in med- ical image segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.191160Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:03c2af1f99c3ed82d00234872971cfe178e406c6d5b58365263c3c8e424fbfbf","observation_id":"421ecc57-2976-471d-a8d5-75b51d2d512f","resolution":{"observed_at":"2026-08-04T20:28:38.191160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.346341Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.346341Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:081be10e500000f05580970fb904883e600ff9bfc58797bf2bfe355819c34afb","observation_id":"ea60081a-a117-4230-98f2-ad1fb3f3df83","resolution":{"observed_at":"2026-08-04T20:28:38.346341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.530750Z","title":"Learningtransferablevisualmodelsfromnaturallanguagesupervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.530750Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:94fbf3bb69294bea5b05434e51e9dfa57c4c09d2d2c052de291cbdbf0a90d42c","observation_id":"9e51322c-0d8a-4cda-a2dd-1bd893f7c85a","resolution":{"observed_at":"2026-08-04T20:28:38.530750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.662209Z","title":"Textual query-driven mask transformer for domain generalized segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.662209Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:0b4befb93c63d13ab94721aaa1c1dd1aad6d05eba8d1c53263804a40568ebd09","observation_id":"95996811-11b0-40c6-98a1-7ea00403bbf4","resolution":{"observed_at":"2026-08-04T20:28:38.662209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.733526Z","title":"Uni- fied contrastive learning in image-text-label space,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.733526Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:6811287078c66d7be33babaca157f0b8bde8fe7345b9eb113e0ebedc7be5c05e","observation_id":"90db9ef3-2e6c-422b-b98e-981035eefd2a","resolution":{"observed_at":"2026-08-04T20:28:38.733526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.821093Z","title":"Pyramidclip: Hierarchical feature alignment for vision-language model pretraining,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.821093Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:ec4739893c8b01970e5b159f3cafedb6451a3eda6c54919ab802446b90b30e94","observation_id":"ec64f166-ba97-4a8a-b3fb-41722f76a2df","resolution":{"observed_at":"2026-08-04T20:28:38.821093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:38.920314Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:38.920314Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:ccc60c2ebd10358e8a81a3ea0de98189b34a0fd2ee72f7913ed269e4b1fbfd1e","observation_id":"111e920a-6b8c-4df4-a2bb-609ada3094c2","resolution":{"observed_at":"2026-08-04T20:28:38.920314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.018536Z","title":"Stronger fewer & superior: Harnessing vision foundation models for domain generalized semantic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.018536Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:774b0f3689c66c925125aa4f561074ee7527db8b1987ed2b6c6fb077c56a7cd0","observation_id":"195c45ec-0f79-4eb7-8654-bac8d07a1d69","resolution":{"observed_at":"2026-08-04T20:28:39.018536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.152082Z","title":"Causality-inspired single-source domain generalization for medical im- age segmentation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.152082Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:0334b48dc68c4c2e178acad894fb8fe79fc19572332006b443290ed2ecaa4669","observation_id":"cebbf11e-1774-43b1-8f9f-dcb8a834a362","resolution":{"observed_at":"2026-08-04T20:28:39.152082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.240659Z","title":"Devil is in channels: Contrastive single domain generalization for medical image segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.240659Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:fa7577e02897a2a36eae946b18939ac74f10c6af4ec2cb470aed5e882cdc97cb","observation_id":"78559ec5-8764-4a23-8bc6-3433b1d1877e","resolution":{"observed_at":"2026-08-04T20:28:39.240659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.325984Z","title":"Single domain generalization for multimodal cross-cancer prognosis via dirac rebalancer and distribution entanglement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.325984Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:ae3de9a961d764ab66a1ecc20ec9e559f314222a88dfb8ec600820b3dffcbc14","observation_id":"4a685c2a-0540-46d5-a3b2-90318582d391","resolution":{"observed_at":"2026-08-04T20:28:39.325984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.402616Z","title":"Denseclip: Language-guided dense prediction with context-aware 26 prompting,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.402616Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:186d5248e4c086f19a1186e038745d6792155da9a67feffb3ddc4cd45c59f279","observation_id":"2c88a0bd-8419-40f0-9109-cce9cd2fc776","resolution":{"observed_at":"2026-08-04T20:28:39.402616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.507684Z","title":"Maximum likelihood from incomplete data via the em algorithm,","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.507684Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:4ff79bfe0b5bc18d6b75a23f7b8a88869f179400762509e4f6e2da88e45d0371","observation_id":"cafbbd45-bfb1-4552-8d82-ad72ab700b6f","resolution":{"observed_at":"2026-08-04T20:28:39.507684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.605237Z","title":"Mamba as a bridge: Where vision foun- dation models meet vision language models for domain-generalized se- mantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.605237Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:d7b345c0ebe6b489e4bd9b6d857ff07652a9d04fc24ef56dbba6e23a094472e2","observation_id":"def837d7-c0a9-4853-8926-1f51d2cfd4dd","resolution":{"observed_at":"2026-08-04T20:28:39.605237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.682308Z","title":"Acceleration of the em algorithm by using quasi-newton methods,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.682308Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:ed43c552bebe583a7a5be660894855822c1baf7604781c55947b202da3e3830f","observation_id":"90887f03-da98-4ec8-9b99-2640592bd7f6","resolution":{"observed_at":"2026-08-04T20:28:39.682308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.791003Z","title":"Prompt tuning for parameter- efficient medical image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.791003Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:11642f1d414f191a43b0b5ee3211da0e311cf93d9f006538b850cc2396317718","observation_id":"8fbcaaa3-9150-442d-b32a-d36e857c367b","resolution":{"observed_at":"2026-08-04T20:28:39.791003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:39.894615Z","title":"Cat: Coordi- nating anatomical-textual prompts for multi-organ and tumor segmen- tation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:39.894615Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:21592ced726c109b4ebca20d9ce00657dd3e0b95529c7b1320c9a96fec4f1344","observation_id":"8027813f-3cd8-4544-b9ac-4a7ba8d46a93","resolution":{"observed_at":"2026-08-04T20:28:39.894615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.012187Z","title":"Multi-modality cross attention network for image and sentence matching,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.012187Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:1dce0eab21748acc36265bd42c68ae05604179a102858ed0de92f540663accc4","observation_id":"132c9503-b433-47de-b897-2d348b3e9e91","resolution":{"observed_at":"2026-08-04T20:28:40.012187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.138474Z","title":"Hierarchical self-attention network for industrial data series modeling with different sampling rates between the input and output sequences,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.138474Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:715f8d6ad80fa7a752bff6714e3e43cbf98c5076138d9a5367e881c52e88ad85","observation_id":"e034cd9b-f0cc-44cf-8d80-13ff51188298","resolution":{"observed_at":"2026-08-04T20:28:40.138474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.249073Z","title":"Transformers in vision: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.249073Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:8e5828ef90b0ac17b3c925aae066b15d5a432703d00a13cfddcc777eb5217e1b","observation_id":"95541161-14e8-40ad-a0a2-849d2beab883","resolution":{"observed_at":"2026-08-04T20:28:40.249073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.337264Z","title":"V-net: Fully convolutional neural networks for volumetric medical image segmentation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.337264Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:eee74fde56f29164a36370734a9c908adcc14c17ade0ab75c1e2babd81798440","observation_id":"293b2886-9c48-4e62-8741-95d6b26cba69","resolution":{"observed_at":"2026-08-04T20:28:40.337264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.425082Z","title":"Learning to prompt for vision- language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.425082Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:f73598140c64587d3299682cb5258d965448d3d7f76d2684d693d20dce79d737","observation_id":"2a10c736-b173-4958-9c12-bf82f65cbf29","resolution":{"observed_at":"2026-08-04T20:28:40.425082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.521564Z","title":"A similarity paradigm through textual regularization without forgetting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.521564Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:03810d13fbf009a1322766842f0a2bca64a8983de0e6fd94d9c0b5c260ecf083","observation_id":"b1a9b18c-ad1d-4b28-af2c-a283d318d17d","resolution":{"observed_at":"2026-08-04T20:28:40.521564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-04T20:28:40.628265Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.628265Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:9ce1f05462f0ad6a8f76cd6e6120884893b0ce723b473ffe74448b15c95743d7","observation_id":"78158dc0-02d6-414b-9898-6001b1677b22","resolution":{"observed_at":"2026-08-04T20:28:40.628265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.752796Z","title":"Deep learning techniques for automatic mri cardiac multi-structures segmen- tation and diagnosis: Is the problem solved?,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.752796Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:5b26dcd66cd53cbda1180be684150cfe281e9cbec4e1189dd03e9c3158149d44","observation_id":"01b116cf-48d5-4688-b4bf-345afec9dc28","resolution":{"observed_at":"2026-08-04T20:28:40.752796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08813","last_updated":"2024-07-18T20:30:28Z","snapshot_observed_at":"2026-08-12T23:23:56.527683Z","submitted_at":"2024-07-11T18:52:32Z","title":"FairDomain: Achieving Fairness in Cross-Domain Medical Image Segmentation and Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08813","snapshot_observed_at":"2026-08-04T20:28:40.880214Z","title":"Fairdomain: Achievingfairnessincross- domain medical image segmentation and classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.880214Z"},"links":{"cited_paper":"/paper/2407.08813","citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:46c4d88acade7dae45c47c9807fed2d0a87dc31798a2964b5f24cd9dd1170b53","observation_id":"462afd20-be56-4c40-b711-0e7812a0eca2","resolution":{"observed_at":"2026-08-04T20:28:40.880214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:40.966053Z","title":"U-net: Convolutional net- works for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:40.966053Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:b778af0cb98c4ff8e473bd7c1c449d4754b85e4faf3b71ab21234da868be2df1","observation_id":"b3a965cd-e01f-4b2c-95fa-881e94cc56e8","resolution":{"observed_at":"2026-08-04T20:28:40.966053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.040000Z","title":"H2former: An efficient hierarchical hybrid transformer for medical image segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.040000Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:e2160e1aef2efd3001b9421aeda0521a3e4c40acc1411fee84206aa45b9f9a3f","observation_id":"8977c82e-621c-4fc5-82a9-c666e5a62490","resolution":{"observed_at":"2026-08-04T20:28:41.040000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.148896Z","title":"Improved regularization of convolutional neu- ral networks with cutout,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.148896Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:05b472ff0a5037922284347aaaf72a0db53cf1f5e6474e3ddd4c2f78f605f257","observation_id":"28470aca-8529-4dfc-b563-1df3484453e8","resolution":{"observed_at":"2026-08-04T20:28:41.148896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.269873Z","title":"Robust and generalizable visual representation learning via random convolutions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.269873Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:e9ea22b3ee42c4ecdb346e9f776d658a3bb05eb7b0ee9dac1feada72d72744d4","observation_id":"d26f7384-3ef9-4e44-b2c0-19f09b61d903","resolution":{"observed_at":"2026-08-04T20:28:41.269873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.350067Z","title":"Domain generalization with mixstyle,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.350067Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:6fcdb0531b204be88095d4d05de63df1c2c40cbd97049c2815172ed90325b72d","observation_id":"592ef65e-deec-4652-acd0-bd4cddcb5689","resolution":{"observed_at":"2026-08-04T20:28:41.350067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.550867Z","title":"Rethinking data augmentation for single-source domain generalization in medical image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.550867Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:ecbfb18021b752e3655870722bd122a08912fe60489561f4a6f66bb987b2d949","observation_id":"cae84a33-56ab-484b-bbf6-5195977fb3cd","resolution":{"observed_at":"2026-08-04T20:28:41.550867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.819842Z","title":"Prompting seg- ment anything model with domain-adaptive prototype for generalizable medical image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.819842Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:35c2c8bf2ee4f8653eb5c1ac425282ebbf79e41e944bae6fc908916f50a4c509","observation_id":"21c65fa8-8146-4d99-90c8-3ec2890f33d1","resolution":{"observed_at":"2026-08-04T20:28:41.819842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:28:41.980645Z","title":"A theory of learning from different domains,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T20:28:41.980645Z"},"links":{"citing_paper":"/paper/2509.08570"},"observation_digest":"sha256:c9326e125bdb0dd8d816fbf26cd6c1a91ee4c82499599d8b3371e1fab4032fb9","observation_id":"3110ab47-5f24-4d2c-967b-39c8dc1984a9","resolution":{"observed_at":"2026-08-04T20:28:41.980645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08570","last_updated":"2025-09-10T13:16:30Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T16:57:59.261022Z","submitted_at":"2025-09-10T13:16:30Z","title":"Vision-Language Semantic Aggregation Leveraging Foundation Model for Generalizable Medical Image Segmentation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2509.08570."}