{"as_of":"2026-08-09T19:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2db951d98ec919a7ab7dd2d6d9a04f8664b9ee93761c8a4767ce50f8e4995f42","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:28:13.001882Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18072/citation-record","integrity":"/paper/2506.18072/integrity","json":"/paper/2506.18072/citation-record.json","paper":"/paper/2506.18072"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.917422Z","title":null,"venue":null,"work_id":"fd1d63b8-58d1-43b0-a5fe-2160117eac55","year":2015},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.234742Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:0d995436828c99783d4687c5945bfac7d9bf48611a8c8310e7bf22705002d9dc","observation_id":"d449e804-f463-4a32-ab1e-56acff0dd912","resolution":{"observed_at":"2026-08-06T23:28:15.944740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.03323","last_updated":"2019-06-20T20:41:58Z","snapshot_observed_at":"2026-07-06T07:44:16.974916Z","submitted_at":"2019-04-06T00:34:39Z","title":"Publicly Available Clinical BERT Embeddings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.03323","snapshot_observed_at":"2026-08-06T23:28:07.271364Z","title":"Publicly available clinical bert embeddings","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.271364Z"},"links":{"cited_paper":"/paper/1904.03323","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:f95ca6f610dd84a5d0982088237202dd3251fd7cfa7d3ea5711d714717d5de82","observation_id":"ce99b672-e3e6-48c9-9de1-1615c5244eca","resolution":{"observed_at":"2026-08-06T23:28:07.271364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.878471Z","title":"Prior: Prototype representation joint learning from medical images and reports","venue":null,"work_id":"d1feea66-27cf-4dd8-99ae-0516a620bf26","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.380815Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:53aad244157195564f0f115b2bbe123a4257a8d6eec5068da68ffa57dbe08a71","observation_id":"f8d216da-63fc-475a-a911-197292f4938e","resolution":{"observed_at":"2026-08-06T23:28:15.885613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.834260Z","title":"Quantifying tumour heterogeneity in 18 f-fdg pet/ct imaging by texture analysis","venue":null,"work_id":"536c9fa2-ff9b-4b78-95e1-a2e0ce34fbe0","year":2013},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.516306Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:69451dc995b8a390b8dcb8fab43a24bd44f7b19d4476e8a7329dfc9188ee955a","observation_id":"46ce62b0-0ae5-43a1-8a48-43102b376823","resolution":{"observed_at":"2026-08-06T23:28:15.858524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.775800Z","title":"As- sessment of tumor heterogeneity: an emerging imaging tool for clinical practice? Insights into imaging , 3:573–589,","venue":null,"work_id":"89f166dc-7de8-4639-9e44-9363f8ac985a","year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.600204Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:806d96dfca236c4adb6f6d867f9f58c66d950b2e37328dd4cb56360698ad3991","observation_id":"a2b0524c-60fc-4aa6-b9ab-9904b9e06b57","resolution":{"observed_at":"2026-08-06T23:28:15.795005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.729497Z","title":"Feedback on a publicly distributed image database: the messidor database","venue":null,"work_id":"61cbe09c-7233-4404-82c7-9b12688251af","year":2014},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.728186Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:fcfa4e5748cceaabc3d1eacf4d355796a5ff9457a1fde3b1c81cc571fcab7f17","observation_id":"46f73411-55ed-4a4a-a01b-d3054b10a814","resolution":{"observed_at":"2026-08-06T23:28:15.748351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.697882Z","title":"Maskclip: Masked self- distillation advances contrastive language-image pretraining","venue":null,"work_id":"143e6abb-92bd-4cec-9f6d-37ae823669de","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.834074Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:8d91485da6ce5e7d317b4be8df08d6aaab1a7b78468f7f3efd47307f84e330b9","observation_id":"31c7f85b-c6d7-481a-b4fc-02f8e73e12fc","resolution":{"observed_at":"2026-08-06T23:28:15.712157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.643755Z","title":"Machine-learning-based multiple abnor- mality prediction with large-scale chest computed tomogra- phy volumes","venue":null,"work_id":"528e6bea-ae84-42ba-854d-11a31152f261","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:07.917459Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:83dbbe5e98e5e77b0af4c8a22113c3bbc940c0799b1b3cd2209bac13dbda566e","observation_id":"efb49268-427e-44f2-ac3f-782a976f0712","resolution":{"observed_at":"2026-08-06T23:28:15.652867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.605286Z","title":"Medbind: Unifying language and multimodal medi- cal data embeddings","venue":null,"work_id":"53d7bacc-cebc-4009-bd7c-e50c91ee862f","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.004186Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:d468aa284181d8017f99c5d94323d9f0aeef11029d61497032c1318bfcb527b8","observation_id":"2e2103d0-b7b1-4f1d-8a36-54d584eac352","resolution":{"observed_at":"2026-08-06T23:28:15.628725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.571535Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":"fec28c00-a592-45ed-b099-4ddae68aa283","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.115873Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:24afdf92e18c5539c7cb77f6ff4a290291d4568871ddc9722f8d84d9cee36c69","observation_id":"e212226b-ed90-4234-b563-ccc31d869bdb","resolution":{"observed_at":"2026-08-06T23:28:15.579531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.474130Z","title":"Anal cancer: Esmo–esso–estro clinical practice guidelines for diagnosis, treatment and follow-up","venue":null,"work_id":"ddcb9809-9e63-44cf-b494-2393097004c7","year":2014},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.215078Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:9123732a736b2496bacfb4f88f170e17a4909d4a2ca35f1c462d1bc885a4034b","observation_id":"2ecf5005-61b1-4cf2-8cba-dd469c480040","resolution":{"observed_at":"2026-08-06T23:28:15.534741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.346675Z","title":"Mimic-iv-ecg: Diagnostic electrocardio- gram matched subset","venue":null,"work_id":"3cae83bf-d764-4d97-9475-fe9af13737e7","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.332508Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:853f3a710ade7a50a79096fadc41e8cb4ef288a90a25ab7efc9cedb8e6cde5f4","observation_id":"030b3eb2-0171-4d37-b79d-953def436cbe","resolution":{"observed_at":"2026-08-06T23:28:15.358534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:08.462195Z","title":"A foundation model utiliz- ing chest ct volumes and radiology reports for supervised- level zero-shot detection of abnormalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.462195Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:e573d5a3be80ecec3b0753e43a46ba4592731a26462eba371833c9374e971c3c","observation_id":"e30142bd-d6ea-4c71-b517-3844f80cc966","resolution":{"observed_at":"2026-08-06T23:28:08.462195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T23:28:08.562643Z","title":"Distilling the knowledge in a neural net- work","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.562643Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:4bfb4ba8dac8ef076cafc3b46e53838af021b049d8b07f14ae6fb04b2eb2c915","observation_id":"ec19bcee-ca1a-4704-aced-557ef8eb2e51","resolution":{"observed_at":"2026-08-06T23:28:08.562643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T23:28:08.689704Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.689704Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:45bea3eb2055284d2ef68114149abb5c89adcdb7bfb3266e6f2a604a04044f72","observation_id":"877c46a3-3d59-425a-b2b4-1e5ad180f2a2","resolution":{"observed_at":"2026-08-06T23:28:08.689704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.303681Z","title":"Gloria: A multimodal global-local represen- tation learning framework for label-efficient medical image recognition","venue":null,"work_id":"5f1ef69b-01f3-46bc-a39d-d44e91f29d53","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.772127Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:c9c61adf6d21c3a669dbe12975a4712097e99b2e7ad0d3bf5f3ec42d06a4f195","observation_id":"d518a5bd-71cb-4abb-af8f-9047b30567f1","resolution":{"observed_at":"2026-08-06T23:28:15.314755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.237694Z","title":"A visual–language foundation model for pathology image analysis using medical twitter","venue":null,"work_id":"9b0c5a53-e6d4-462d-a3a5-d2b6acfbd131","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.785967Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:ba6f179a7b0eb7de5fef5227f616292aa0024ed426c47feec1b691e05d75583a","observation_id":"8d6f62a4-d112-422e-8046-e84f4c6cde0a","resolution":{"observed_at":"2026-08-06T23:28:15.262642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.209484Z","title":"Modern diagnostic imaging technique applications and risk factors in the medical field: a review","venue":null,"work_id":"9e3f5bd8-aad6-4383-b7c6-a3e3e5e846a5","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:08.893403Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:1f57fc9b042fbc6a641307d24f3ac0d8817f0c4ed618078b2c01ceb1e3dafc95","observation_id":"9b423863-73c6-4bf5-95e5-210a87f9179c","resolution":{"observed_at":"2026-08-06T23:28:15.217991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.133843Z","title":"Quilt-1m: One million image-text pairs for histopathology, 2023","venue":null,"work_id":"30effde3-f015-4eea-8df0-4c623d09c95d","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.012503Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:97d3f2f048cfdfe819e27344932aacee27448783e5b15391b0e4de3fe8a0dd78","observation_id":"ded1b7af-33e8-4163-a2bb-da694b10b94d","resolution":{"observed_at":"2026-08-06T23:28:15.165003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:09.124390Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and expert comparison","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.124390Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:c084ab65ebb85cbb30b5cbbc4c7955c27f52f41d30635b45e14be00a0324199e","observation_id":"4e83ab8b-6d5c-45c8-90d9-3065a3ae8128","resolution":{"observed_at":"2026-08-06T23:28:09.124390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-06T23:28:09.248145Z","title":"Tinybert: Distill- ing bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.248145Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:71b0d4e43c50c0e5cba536fe13019c85063699aae8763c3524fc5b3c5b28ce03","observation_id":"4080a1aa-4628-45d0-86f8-72a82dbc1432","resolution":{"observed_at":"2026-08-06T23:28:09.248145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10372","last_updated":"2024-12-13T18:59:40Z","snapshot_observed_at":"2026-07-06T20:06:43.917795Z","submitted_at":"2024-12-13T18:59:40Z","title":"UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10372","snapshot_observed_at":"2026-08-06T23:28:09.350646Z","title":"Unimed- clip: Towards a unified image-text pretraining paradigm for diverse medical imaging modalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.350646Z"},"links":{"cited_paper":"/paper/2412.10372","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:2c3260a5b0afb9acd99ea931f1e13d5670a1b4115dcb7aeb8aeeb51098364082","observation_id":"c902c611-d289-432e-9b79-8b2dafd7d782","resolution":{"observed_at":"2026-08-06T23:28:09.350646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:15.046771Z","title":"Deep learning for the detection of anatomical tissue structures and neoplasms of the skin on scanned histopathological tissue sections","venue":null,"work_id":"cebbb447-8f79-43e2-a668-2deb3a91aa5e","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.449043Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:60fc975f62ac4e0a6aa5adf2fe0e6430b1bb70c34a4274ed6c879de8dafbe0c5","observation_id":"f8a10ad9-d40b-4084-9a7b-f2bffef89512","resolution":{"observed_at":"2026-08-06T23:28:15.068287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:09.580548Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.580548Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:203e858603fb1e9ff70f4bd68de4232c7d2bd4c3ae94314fed22f4d98e1aa8a4","observation_id":"53e2af40-21f9-4ce2-9e42-45112e49afd9","resolution":{"observed_at":"2026-08-06T23:28:09.580548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.982117Z","title":"Grounded language-image pre-training","venue":null,"work_id":"372043d2-f60e-43c3-a42b-8ccbd608f7c9","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.674335Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:43db67e84d3d572a376e9f61ad73c904e4c405f50f01a6cd60585210a4aa5d1e","observation_id":"a3a7d4ea-a431-4436-83b4-1b4814b43963","resolution":{"observed_at":"2026-08-06T23:28:14.998419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.930789Z","title":"Scaling language-image pre-training via masking","venue":null,"work_id":"3006a72f-d145-427c-9e28-6f9d5b8f8995","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.791695Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:caf0eda608392bcea64c68bfd6f62260533106feb4fdd98176f6287bf0a653f5","observation_id":"83c4146b-8fd8-449f-8339-29891922cb16","resolution":{"observed_at":"2026-08-06T23:28:14.947249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.870222Z","title":"Retinal vascular imaging: a new tool in microvascular dis- ease research","venue":null,"work_id":"98bb4dc8-a99a-489c-95ce-f2e2c24be563","year":2008},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.866271Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:ebebe844d583846bec6ba23a3b32e2f780d63a26221f1f36c7d04ca11b750b65","observation_id":"b61553ce-be21-4dc5-a5dd-d866c8913189","resolution":{"observed_at":"2026-08-06T23:28:14.903510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.836153Z","title":"An Open Access Database for Evaluating the Algorithms of Electro- cardiogram Rhythm and Morphology Abnormality Detec- tion","venue":null,"work_id":"be04b997-4f8a-4f7a-b0c5-7ed3911e7ce4","year":2018},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:09.991703Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:faf4cfd592ab0931d552e316abb252a691a5baa2d7cbbbcfb9842cb9af412d7c","observation_id":"f13e95e5-2c43-44a4-bf8f-e39f7f481800","resolution":{"observed_at":"2026-08-06T23:28:14.850148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.814550Z","title":"Cells, tissues, and disease: principles of general pathology","venue":null,"work_id":"898b5935-a715-484b-99dd-8204d74d5421","year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.148560Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:c7cc2c4307a7cd1c311f16e5795ba4890ef99cb660cfd0d9f05eaab715fd109d","observation_id":"1051f69d-4bd5-4c6c-b79a-e43544e24243","resolution":{"observed_at":"2026-08-06T23:28:14.820297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.781448Z","title":"Electrocardiography","venue":null,"work_id":"6b1d0cff-7cc2-4de5-9e1f-1e2586796f69","year":2001},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.257813Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:791ebaf7c366fb450f1865d9778caf6e744152aa946c154cdeab20d1e729080a","observation_id":"e01d9072-9b35-4f11-8bd5-1f90b2c443e9","resolution":{"observed_at":"2026-08-06T23:28:14.797911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:10.404625Z","title":"Im- proved knowledge distillation via teacher assistant","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.404625Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:91d0deb951c037a14d790b807272069c2e48777d70a322fb91cb338f8c6bafad","observation_id":"c739753a-386b-47f6-9fe5-27f4c6f82589","resolution":{"observed_at":"2026-08-06T23:28:10.404625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.725429Z","title":"Slip: Self-supervision meets language-image pre- training","venue":null,"work_id":"b24cb948-d566-4d59-8a1d-3003c5a67401","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.514765Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:8fd955daff2752bd0086a785660df95f757fb073a5bc34a89b691a7fed30699a","observation_id":"61ac73ff-cec3-4e06-a279-72d73ce972b4","resolution":{"observed_at":"2026-08-06T23:28:14.740566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.669258Z","title":"Imaging biomarker roadmap for cancer studies","venue":null,"work_id":"0f0763fc-56c8-4eb4-bc63-c1b199ab8a1b","year":2017},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.635991Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:3d27f02507d6e0291a9d4433b9e94f20fbead6a0a5d9d6b9f8952b47b6c8f955","observation_id":"e06a81aa-6d90-41a8-a021-55becbc681c8","resolution":{"observed_at":"2026-08-06T23:28:14.688487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.625148Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"11c1f07a-92fe-4dc1-9c64-bb77fd46f076","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.724749Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:1c68968b2915aa24355521f1c3e76556612807c7682199e977e54b5d6acda527","observation_id":"e1fa2ad1-3acb-42d6-8f84-8f7c99a61c8b","resolution":{"observed_at":"2026-08-06T23:28:14.634745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.534375Z","title":"Computed tomography: revolutionizing the practice of medicine for 40 years","venue":null,"work_id":"21eee05c-2b63-404d-88b6-ba2cdd24d50d","year":2014},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.826330Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:2c060317efc14e76b2db8124619a47b192381d501feed2fae7ded6f0135bc43f","observation_id":"952d8afa-902e-434b-be2e-d8d09cb1c225","resolution":{"observed_at":"2026-08-06T23:28:14.558177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-06T23:28:10.922563Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:10.922563Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:1c246c844ab4d8b752e87ebf531c7f64e40d3cb3ede9076b9f0b1857d95e3cc0","observation_id":"5d047baa-8550-4eeb-97f9-372bf9e4aeff","resolution":{"observed_at":"2026-08-06T23:28:10.922563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.494122Z","title":"Going deeper through the gleason scoring scale: An automatic end-to-end system for histology prostate grading and cribriform pattern detec- tion","venue":null,"work_id":"6d5599d7-db33-4dd3-a880-335c13cad281","year":2020},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.057460Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:6ec35cdc6b57f43e1de786c1dc1174e3cb3ca52c7dfcefcee10e4d29e94189aa","observation_id":"2ea250c9-b9bb-4a54-8cfb-0aa82a5e449a","resolution":{"observed_at":"2026-08-06T23:28:14.509236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.461812Z","title":"A foundation language-image model of the retina (flair): Encoding expert knowledge in text supervision","venue":null,"work_id":"bc3f3d63-c40f-41ce-a2e0-83733583e637","year":2025},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.118039Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:b320828a0784f8108e9f6ff20695849bb929fa402c0ca0344297fec528fd85b7","observation_id":"738bc5d4-ed0c-4ce8-8fd7-42e12cc7b87f","resolution":{"observed_at":"2026-08-06T23:28:14.477769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08849","last_updated":"2024-12-10T15:35:31Z","snapshot_observed_at":"2026-07-06T19:15:00.165369Z","submitted_at":"2024-09-12T17:59:08Z","title":"DeCLIP: Decoding CLIP representations for deepfake localization","version":2},"cited_work":{"arxiv_id":"2409.08849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.08849","snapshot_observed_at":"2026-08-06T23:28:13.366835Z","title":"DeCLIP: Decoding CLIP representations for deepfake localization","venue":"cs.CV","work_id":"89b386bc-b225-4332-8c68-20a5b83da026","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.234539Z"},"links":{"cited_paper":"/paper/2409.08849","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:87d02cd0c535db6f180b3d23708d1ec34f67d461a22587930db172fab31c632f","observation_id":"76b5b8bd-d08f-4a80-badf-0457e6ea2020","resolution":{"observed_at":"2026-08-06T23:28:13.376692Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.440000Z","title":"Chest radiography in general practice: indications, diagnostic yield and consequences for patient management","venue":null,"work_id":"8473355e-a2a3-4e8b-9ed7-cc136e6a6c82","year":2006},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.406849Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:3da45d2eed793911d3bb0229a3b49b961d8ae301437e6dd13a8370e5fbe01c29","observation_id":"495e251e-726c-43dd-badf-8d1cc63006b3","resolution":{"observed_at":"2026-08-06T23:28:14.448817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.408781Z","title":"Dime-fm: Distilling multimodal and efficient foundation models","venue":null,"work_id":"23342eaf-16f2-4ae6-a77b-2a410adb7d6f","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.534732Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:055236add385f7cf9ef5ea9bf932f8196448dde8975ff97e92172998557d11f8","observation_id":"cc6787e2-c145-4f98-8c46-ba660ef126cc","resolution":{"observed_at":"2026-08-06T23:28:14.414765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.374030Z","title":"Alpha- clip: A clip model focusing on wherever you want","venue":null,"work_id":"ab946b1b-ab86-45f1-9aa5-9f195f1a6cf1","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.622221Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:7304786abd6acfa29ec60c78b0a006f21e90d5229447872a397443ed9d34e3b0","observation_id":"2ded2519-967f-4b8e-8505-783a05dba0c4","resolution":{"observed_at":"2026-08-06T23:28:14.389545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.264343Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":"8f8ca397-baee-4a27-97ae-74268a285499","year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:11.907313Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:1dcd08dc86bdaeef8481c149de72e7002c46a6ed4ab12d934efa454c81d47774","observation_id":"12546e7e-d03e-4b9f-a0b7-09b0baac8979","resolution":{"observed_at":"2026-08-06T23:28:14.304829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.203331Z","title":"Rotation equivariant cnns for digital pathology","venue":null,"work_id":"365f8417-44c4-4e1e-9ef3-66c351140c0f","year":2018},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.132600Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:2b2ad7178ec5faa810f8668395a0aac6913be2411aa649510c02d7dc4431d948","observation_id":"80e4fe9f-f65e-44b7-920e-96f50bea6fc4","resolution":{"observed_at":"2026-08-06T23:28:14.221016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.172591Z","title":"Ptb-xl, a large publicly available electrocardiog- raphy dataset","venue":null,"work_id":"972817f2-638b-431e-bc7a-e2dd68929eb1","year":2020},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.250670Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:37d83bbfe7dde84e11d1ce8d3cafcdd497f0af8ac1972da74ef1df1eb6d32ba3","observation_id":"d2d7b2a7-cff7-4187-9a54-7ee9daac4154","resolution":{"observed_at":"2026-08-06T23:28:14.185702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.134735Z","title":"Multi-granularity cross-modal align- ment for generalized medical visual representation learn- ing","venue":null,"work_id":"43500d05-01d8-4e17-8d34-7b9b468136e5","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.345227Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:b51f3d9aed8fd9a990ffd1c69cfdac70b44aba2b6ad1c3d5ea63f167b51b0327","observation_id":"a79dda0e-3ace-4242-8034-cd853e87cdb4","resolution":{"observed_at":"2026-08-06T23:28:14.152099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:14.025551Z","title":"Efficient image captioning for edge devices","venue":null,"work_id":"5943ad42-8e39-48ed-8c42-663b998cc289","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.469190Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:a4f8e3e16a0f1b8e2c72add74b52bc57225374a4d8a9a19c4f8c695db2e309e4","observation_id":"eaf857f1-b1d0-4dfd-ae4c-b65a98ce5380","resolution":{"observed_at":"2026-08-06T23:28:14.084991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.958547Z","title":"Tinyvit: Fast pretraining distillation for small vision transformers","venue":null,"work_id":"04431447-df71-4f94-91e4-dbaf8e3e4d77","year":2022},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.548030Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:acef66486abda555a80cfbee6cb21470d640b44cb390fc6ede627d2ef0721895","observation_id":"c21021bb-2653-41a8-b8e0-5f6f0287b696","resolution":{"observed_at":"2026-08-06T23:28:13.968986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.929491Z","title":"Tinyclip: Clip dis- tillation via affinity mimicking and weight inheritance","venue":null,"work_id":"8eb6f547-ad6b-4e67-91da-dea77f069302","year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.654056Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:932214af8f0fdc48a0bb959ca411de721f6db8f818ccb3b47bda6415ad3f12fc","observation_id":"737567ca-5d89-415e-9644-4e2d34c4fc49","resolution":{"observed_at":"2026-08-06T23:28:13.940199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.880509Z","title":"Clip-kd: An empirical study of clip model distillation","venue":null,"work_id":"d03b20a9-617b-4a05-9836-1ed89b1d34e4","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.797659Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:b358a9d231df76b8a2b7eb5d779df08d520279fde5a5f7898448eb4928ea0d1d","observation_id":"607a35a7-b5b9-49ce-9ee7-5ae5c8832840","resolution":{"observed_at":"2026-08-06T23:28:13.900745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09441","last_updated":"2024-12-16T11:26:26Z","snapshot_observed_at":"2026-07-06T19:02:03.017798Z","submitted_at":"2024-08-18T11:23:21Z","title":"CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination","version":2},"cited_work":{"arxiv_id":"2408.09441","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.09441","snapshot_observed_at":"2026-08-06T23:28:13.294364Z","title":"CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination","venue":"cs.CV","work_id":"30218e7f-ab38-4575-8e78-07b89a2cb515","year":2024},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.853542Z"},"links":{"cited_paper":"/paper/2408.09441","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:e2f5f0a4eaef5bc8a0305750773b97d298e2e0df635267253de9f66623b5da1b","observation_id":"e9b23b80-f4f9-4880-b88a-fbf865742c95","resolution":{"observed_at":"2026-08-06T23:28:13.319921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07783","last_updated":"2021-11-09T17:15:38Z","snapshot_observed_at":"2026-07-06T12:08:35.761426Z","submitted_at":"2021-11-09T17:15:38Z","title":"FILIP: Fine-grained Interactive Language-Image Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07783","snapshot_observed_at":"2026-08-06T23:28:12.914424Z","title":"Filip: Fine-grained interactive language-image pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.914424Z"},"links":{"cited_paper":"/paper/2111.07783","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:058ab72a0ce4f2c457ba64b58b5ba1feca593883ee459a18087ab1429e04ee65","observation_id":"e18e71dd-2079-4c9d-97c5-8feaabc0f774","resolution":{"observed_at":"2026-08-06T23:28:12.914424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-07-06T14:57:39.647497Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-06T23:28:12.934924Z","title":"Biomedclip: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.934924Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:335cbc63d927ccf80c7facb05c3a1b598840b136a6dac8082c31c3d3c25e979e","observation_id":"0826940a-6cfc-474b-8970-0b0159f5516a","resolution":{"observed_at":"2026-08-06T23:28:12.934924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.833953Z","title":"Contrastive learning of medical visual representations from paired images and text","venue":null,"work_id":"71a991f9-9dd2-4ae0-ad18-d950050ffd58","year":null},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.956611Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:851072e374a3e690eac51b9aae7efa8b3ab02c841647f7b4b3397b45fb602f8b","observation_id":"5e170c9b-916f-4727-8dee-d69fcdf9a60c","resolution":{"observed_at":"2026-08-06T23:28:13.852122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:13.789200Z","title":"Bira-net: Bilinear attention net for diabetic retinopathy grading","venue":null,"work_id":"4894a670-a5c0-49e3-95cc-4eca4a031331","year":2019},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:12.973603Z"},"links":{"citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:249bf8a84ce50c7a172e55bde3f269294d6655842f434101166283ac70e5e1d3","observation_id":"e7e73ffa-5f3e-4afd-92f4-49b4fed36d9f","resolution":{"observed_at":"2026-08-06T23:28:13.803462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-07-31T04:25:37.437501Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-08-06T23:28:13.001882Z","title":"Clip in medical imaging: A comprehensive sur- vey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:13.001882Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2506.18072"},"observation_digest":"sha256:5b4f0623f42ed99a13e54ab33e1f44da7de4821deb759fc1c618c8f8ee914966","observation_id":"3cfbe601-b0a5-4254-b90c-b93fc3049210","resolution":{"observed_at":"2026-08-06T23:28:13.001882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18072","last_updated":"2025-09-03T16:04:55Z","latest_version":2,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-08T07:19:07.610721Z","submitted_at":"2025-06-22T15:39:25Z","title":"Multimodal Medical Image Binding via Shared Text Embeddings"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":40},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2506.18072."}