{"as_of":"2026-08-13T03:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:840cbd0588b51167a05173b87dad6936339bd8cd807da08a599b4ad597276ab3","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:09:15.626675Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:38:45.428427Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T21:38:48.445520Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"cited_work":{"arxiv_id":"2506.22567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.22567","snapshot_observed_at":"2026-08-05T21:38:48.445520Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","venue":"cs.CV","work_id":"62e5366c-1ad6-4d3a-a7c7-1fcf5d21b950","year":2025},"citing_paper":{"arxiv_id":"2508.08224","last_updated":"2025-08-13T05:32:22Z","snapshot_observed_at":"2026-08-08T06:54:01.807606Z","submitted_at":"2025-08-11T17:43:45Z","title":"Capabilities of GPT-5 on Multimodal Medical Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:38:45.428427Z"},"links":{"cited_paper":"/paper/2506.22567","citing_paper":"/paper/2508.08224"},"observation_digest":"sha256:5d84799ce9e7e6bf3ab8c3e38f9d3f228eb0cd2b0546ca96c889568b33b46f4d","observation_id":"1714f79a-990d-41ea-812c-5020fa6864d7","resolution":{"observed_at":"2026-08-05T21:38:48.592280Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.22567/citation-record","integrity":"/paper/2506.22567/integrity","json":"/paper/2506.22567/citation-record.json","paper":"/paper/2506.22567"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.688443Z","title":"Clip and complementary methods","venue":null,"work_id":"a2b158c7-1136-465e-bf73-08a26b9aebed","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.498720Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:d6242bdd24f8401ae1e29bf319d8843cbd1499939be025d5eaf69eefba7729fa","observation_id":"96ba57ab-1d5d-45b6-81fe-1387b901a03e","resolution":{"observed_at":"2026-08-06T22:10:19.763399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:05.611245Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.611245Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:780e74ccdb41d1960786a46ca3b7f10c3fa325ae56e02b579e342af724391d0b","observation_id":"a8796f18-db02-4bb5-a4c2-f558a36013c1","resolution":{"observed_at":"2026-08-06T22:09:05.611245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.513548Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"d4be71fc-f0de-43a7-a250-98bda5bd7152","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.728940Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:7a33c45a220915fa4d1b5666979c740d395f32dde8b6993e02f9aa4cbdfdec8a","observation_id":"78238203-5109-4545-acb2-c6d1f86aaa6c","resolution":{"observed_at":"2026-08-06T22:10:19.575937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:05.881143Z","title":"Foundation models for generalist medical artificial intelligence","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:05.881143Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:94b48c4a7273ea5e8f53836ce2abb96f47dea6c93afcb4cfd2e25e97c90f42fc","observation_id":"f56b83c6-c6ab-46c3-92c4-0e7a5f9e495f","resolution":{"observed_at":"2026-08-06T22:09:05.881143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:06.056193Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.056193Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:6908141a318de449bd531ed418146641bc5a36e959ed90091b3473ee314796a7","observation_id":"4e5ef586-e0e9-4176-bb57-c44362e4fab8","resolution":{"observed_at":"2026-08-06T22:09:06.056193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.389378Z","title":"Cxr-clip: Toward large scale chest x-ray language-image pre-training","venue":null,"work_id":"b0aeebfe-060b-4567-8483-544fd67dd2d3","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.180448Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:aec8a49fca23c20073dde1c46dc4dea6dd07366f0e660906977e984bc1d9d947","observation_id":"d975457a-bd07-48b2-a247-b4e14633662f","resolution":{"observed_at":"2026-08-06T22:10:19.451742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:06.279074Z","title":"Merlin: A vision language foundation model for 3d computed tomography","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.279074Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:e57ce7cfe90b5b05bf36b36a254bbe10297ef4f15e1703d4d602280056bc36ec","observation_id":"7ac1f250-2e6a-4046-8815-13d3ea8e3d88","resolution":{"observed_at":"2026-08-06T22:09:06.279074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.244891Z","title":"Artificial intelligence for multimodal data integration in oncology","venue":null,"work_id":"6675618c-8887-4e57-a6e0-674cb855b711","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.440088Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:02d9b534b5f652ce05c85ad6677cf4a1de2b891dbbe5d0504be370072fbb997e","observation_id":"4fee011c-cb58-40cd-a41a-bee4fc27cb08","resolution":{"observed_at":"2026-08-06T22:10:19.334884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14064","last_updated":"2025-02-23T03:13:01Z","snapshot_observed_at":"2026-08-10T20:24:18.087350Z","submitted_at":"2025-02-19T19:31:52Z","title":"Triad: Vision Foundation Model for 3D Magnetic Resonance Imaging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14064","snapshot_observed_at":"2026-08-06T22:09:06.524513Z","title":"Triad: Vision foundation model for 3d magnetic resonance imaging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.524513Z"},"links":{"cited_paper":"/paper/2502.14064","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5fc9ab9fa688f29680ed30125b06a864e21dd3d13bfd8cc701ca5588cf103fb1","observation_id":"06a9fa43-d70d-49c6-9daa-fce7085fd0cb","resolution":{"observed_at":"2026-08-06T22:09:06.524513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:19.131781Z","title":"A whole-slide foundation model for digital pathology from real-world data","venue":null,"work_id":"dc56ac34-24dd-4c85-bb41-d6f3f917712d","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.527790Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:b5aecd23ee4ffc6d647120d6955c22ac0c34a1de57e35c8da87dda53061df9e7","observation_id":"b04e16c4-4307-43cb-a8d0-fb111bbe9ecf","resolution":{"observed_at":"2026-08-06T22:10:19.185954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.926490Z","title":"A visual–language foundation model for pathology image analysis using medical twitter","venue":null,"work_id":"1dda675d-dc78-4479-a5ac-1b6c46e33a59","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.531758Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:402558b379df295966bdaf1483cf3fc1fcf7771e29b6f17e5b24820df3cab59a","observation_id":"f2e20680-ed10-4f92-b0e4-bbac30882d93","resolution":{"observed_at":"2026-08-06T22:10:19.033187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.733774Z","title":"A foundation model for generalizable disease detection from retinal images","venue":null,"work_id":"52bed81e-6015-4c70-b175-5e86211b744d","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.610421Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:8a52c625a960b1aed01c736f4fe81f3315aa8f3a0837fa87a9f13430f14fde48","observation_id":"7d39bbcc-626c-4e6c-9bb6-7b34412a53db","resolution":{"observed_at":"2026-08-06T22:10:18.820143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15421","last_updated":"2024-11-26T13:25:34Z","snapshot_observed_at":"2026-08-12T14:17:16.896517Z","submitted_at":"2024-11-23T02:53:08Z","title":"OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15421","snapshot_observed_at":"2026-08-06T22:09:06.737442Z","title":"Ophclip: Hierarchical retrieval-augmented learning for ophthalmic surgical video-language pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.737442Z"},"links":{"cited_paper":"/paper/2411.15421","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5bf0901069f9781c0e193799353cce48d3c1a4fe7267fa504e5ff30b2c2315b3","observation_id":"663ded04-a4cf-417c-a503-f347e8d22ccf","resolution":{"observed_at":"2026-08-06T22:09:06.737442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:06.892066Z","title":"Transparent medical image ai via an image–text foundation model grounded in medical literature","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:06.892066Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:11a73be0fdb1a64c8230a154480fe14de68feb86f845dc2677aac2513b7c883c","observation_id":"61256a0d-298e-4106-8cc7-5b28ccc79cf9","resolution":{"observed_at":"2026-08-06T22:09:06.892066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.545080Z","title":"A generalist vision–language foundation model for diverse biomedical tasks","venue":null,"work_id":"000ecb23-6fe9-433c-9347-232cf808b1b0","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.061313Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:9f89924810339237b38db9d038c332996c39185d2a21988716188b572521cc5a","observation_id":"51521a6e-f79e-4c4f-ae14-17bcc45e6ca4","resolution":{"observed_at":"2026-08-06T22:10:18.601237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-12T16:45:38.399582Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-06T22:09:07.229393Z","title":"Quantifying the reasoning abilities of llms on real-world clinical cases","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.229393Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:705aee23aa40d2a4596a98b723d07661ea4fb5466ab0cf998e37443c29d6b03b","observation_id":"3391c1e2-2fd8-4417-a6ec-7c27e67d08fa","resolution":{"observed_at":"2026-08-06T22:09:07.229393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.396147Z","title":"Unsupervised mri motion artifact disentanglement: introducing maudgan","venue":null,"work_id":"ca86ffc9-82f0-4e86-a21f-04a9c12a7f83","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.404228Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1fc3ae9f42a486d338a0965b4cb552414414d2c8a9a3545d826232065e2e5892","observation_id":"244163b3-b314-49db-b9e7-0b157dadcee6","resolution":{"observed_at":"2026-08-06T22:10:18.434680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.383075Z","title":"Mri super-resolution reconstruction using efficient diffusion probabilistic model with residual shifting","venue":null,"work_id":"c89cb448-2027-4614-9c6d-3f288e2b6d69","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.562529Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:70b1e5c164d26c8f8dcf2acb3bbeeacfb8c312e6d339254fb076c6c021671ba7","observation_id":"9b8d622c-b1cf-4115-a559-dffbab728116","resolution":{"observed_at":"2026-08-06T22:10:18.387777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06898","last_updated":"2025-05-11T08:32:01Z","snapshot_observed_at":"2026-08-07T15:48:09.842982Z","submitted_at":"2025-05-11T08:32:01Z","title":"Multi-Modal Explainable Medical AI Assistant for Trustworthy Human-AI Collaboration","version":1},"cited_work":{"arxiv_id":"2505.06898","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.06898","snapshot_observed_at":"2026-08-06T22:09:16.440837Z","title":"Multi-Modal Explainable Medical AI Assistant for Trustworthy Human-AI Collaboration","venue":"cs.CV","work_id":"39835ba8-723a-4ece-ad02-89c9fd00cd60","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.681566Z"},"links":{"cited_paper":"/paper/2505.06898","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:a0779bbdba49ef28c4e3e0b54307ba41896242eace785c9f762005b881bde7eb","observation_id":"15bb0f42-7c7e-4c00-a372-a77e1e2559a8","resolution":{"observed_at":"2026-08-06T22:09:16.560723Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.268360Z","title":"Deep learning based multimodal biomedical data fusion: An overview and comparative review","venue":null,"work_id":"f48e1e60-f490-4730-a1d6-1bec96075efd","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.792392Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:b5f9bc8e03de85a4ae614f5e7534f194162c1f751e711a4b578024154edf2815","observation_id":"b571ac72-089f-4a92-a092-b35fa05ae35a","resolution":{"observed_at":"2026-08-06T22:10:18.336478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:18.132211Z","title":"The future of multimodal artificial intelligence models for integrating imaging and clinical metadata: a narrative review","venue":null,"work_id":"ef7da775-f12e-4696-8097-aed3b35be544","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.951396Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:477fe33cd8d187b28b8dfe0c257d7411c46947a42b8663c1a8b5962e6ab89183","observation_id":"ef7e8cb6-9228-46b3-9977-bf5949f3c164","resolution":{"observed_at":"2026-08-06T22:10:18.186449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:10:17.942796Z","title":"Pmc open access subset","venue":null,"work_id":"2d86d928-f660-41a0-a6e5-7234c2c8fd46","year":2003},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.074142Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:25a01e844ff43a346ed2e389010d5e5e7813ccd639518cf29119c54333cf43b9","observation_id":"be6161bb-a1c0-4218-87a2-79be34f3ecd9","resolution":{"observed_at":"2026-08-06T22:10:18.012983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.765842Z","title":"Pmc-clip: Contrastive language-image pre-training using biomedical documents","venue":null,"work_id":"a2a52ba6-c60c-4cc4-b9e8-183598111785","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.179419Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:12ed64254504dcca50f4ee240f9ca7e2a86c37fb57b284870c69677554372003","observation_id":"e7e94c61-ee64-4c31-9b3d-faf22552cf44","resolution":{"observed_at":"2026-08-06T22:10:17.796190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07171","last_updated":"2025-04-01T19:50:25Z","snapshot_observed_at":"2026-08-10T20:46:09.116813Z","submitted_at":"2025-01-13T09:58:03Z","title":"BIOMEDICA: An Open Biomedical Image-Caption Archive, Dataset, and Vision-Language Models Derived from Scientific Literature","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07171","snapshot_observed_at":"2026-08-06T22:09:08.268784Z","title":"Biomedica: An open biomedical image-caption archive, dataset, and vision-language models derived from scientific literature","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.268784Z"},"links":{"cited_paper":"/paper/2501.07171","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3891cf978b05eba60944f00324abaa7f4b56f459bd09a57675cb47ff00a7a1c9","observation_id":"49d28a79-d629-4158-bee3-97fd544f4eaf","resolution":{"observed_at":"2026-08-06T22:09:08.268784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15579","last_updated":"2025-04-26T08:58:40Z","snapshot_observed_at":"2026-08-10T14:07:11.917731Z","submitted_at":"2025-01-26T16:07:11Z","title":"An Explainable Biomedical Foundation Model via Large-Scale Concept-Enhanced Vision-Language Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15579","snapshot_observed_at":"2026-08-06T22:09:08.348110Z","title":"Conceptclip: Towards trustworthy medical ai via concept-enhanced contrastive langauge-image pre-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.348110Z"},"links":{"cited_paper":"/paper/2501.15579","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:55c3461b723fdbb039fed11b4378d2d45ee04fbc93521b4e3e3f56d617846fc6","observation_id":"4a13254b-659f-40e1-990c-5ae073f8bfd6","resolution":{"observed_at":"2026-08-06T22:09:08.348110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.620399Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"cea1c40b-a18f-4912-a742-4cb14e684ed4","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.426292Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:28fcd6f9eeb1f6f795277feae6430e60a9ad48f307e74f394bd98840b722fdb4","observation_id":"eb4d1cb3-3813-49af-99f1-a60d7ee65de3","resolution":{"observed_at":"2026-08-06T22:09:23.690551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.442889Z","title":"Clip-kd: An empirical study of clip model distillation","venue":null,"work_id":"875372c3-01e5-456e-9227-7d3badce41c6","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.516567Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:166fdcfedc0b295338382e678f08db96bf051080458af5b2237119953ff87579","observation_id":"901a58d4-d5e4-4c92-9aff-920767e4feb3","resolution":{"observed_at":"2026-08-06T22:09:23.535033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06386","last_updated":"2022-03-30T06:01:53Z","snapshot_observed_at":"2026-08-10T00:57:22.772498Z","submitted_at":"2022-03-12T09:33:37Z","title":"Enabling Multimodal Generation on CLIP via Vision-Language Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06386","snapshot_observed_at":"2026-08-06T22:09:08.626731Z","title":"Enabling multimodal generation on clip via vision-language knowledge distillation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.626731Z"},"links":{"cited_paper":"/paper/2203.06386","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:826660ef96b55a4196336789c70827aa3e2b178f00eb5b027af66116354f026c","observation_id":"2bcd8bbb-7039-49fb-b31c-96c56a697df5","resolution":{"observed_at":"2026-08-06T22:09:08.626731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:08.764595Z","title":"Medicalnarratives: Connecting medical vision and language with localized narratives","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.764595Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:8d14e7f321840621b2c33568fc8da442b84df086883af43ee69be24fb0fe6465","observation_id":"954023f3-4d96-40f1-a9f3-c326ecd5389f","resolution":{"observed_at":"2026-08-06T22:09:08.764595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.259637Z","title":"Medclip: Contrastive learning from unpaired medical images and text","venue":null,"work_id":"1d6f4c7d-2d66-4119-b6cd-d7bcd8e2d795","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.889114Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:45b49874e0cae4b9e1ffff7fb29530b5759b98c3b6a4b35d906b091450e1175b","observation_id":"10492f40-8dd8-4cda-86db-59bdf23eb6c6","resolution":{"observed_at":"2026-08-06T22:09:23.350351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:23.046880Z","title":"A multimodal biomedical foundation model trained from fifteen million image–text pairs","venue":null,"work_id":"07059485-99fe-48c1-9f0c-879a16461d8e","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:08.984350Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:35932fd88bfb51e5996313df03b6a215ce5108e0a115d808e7f87d0e2aadba4b","observation_id":"7f9543a3-e316-43ca-b8fa-b831c31b11ec","resolution":{"observed_at":"2026-08-06T22:09:23.113274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10372","last_updated":"2024-12-13T18:59:40Z","snapshot_observed_at":"2026-08-11T15:52:36.736949Z","submitted_at":"2024-12-13T18:59:40Z","title":"UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10372","snapshot_observed_at":"2026-08-06T22:09:09.209532Z","title":"Unimed-clip: Towards a unified image-text pretraining paradigm for diverse medical imaging modalities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.209532Z"},"links":{"cited_paper":"/paper/2412.10372","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:dc08d22746d1c4bf9b7d64bd29e8ed420fd5d321ada6c9e0cf4edf334adee804","observation_id":"8b2addf9-1076-464c-bc6c-eae20b642c71","resolution":{"observed_at":"2026-08-06T22:09:09.209532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.784383Z","title":null,"venue":null,"work_id":"b3dacd07-0ad8-44d1-90c6-15bf0a10f3dd","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.376378Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5d6f0f79c2cd57dc7b20cbb4719c73d3a12ac2c9fe90055679eb5a6595d80599","observation_id":"48e01aca-1c84-454d-959a-4f4f0e23162b","resolution":{"observed_at":"2026-08-06T22:09:22.932945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.590996Z","title":"Quilt-1m: One million image-text pairs for histopathology","venue":null,"work_id":"59f414f9-bbb7-48c4-84c3-0ba92db90705","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.546420Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:aeaadebd759f800f682413cd8def2d53ca1431df5e77e0d08e0d3cdcbe0c7890","observation_id":"1135adcc-b56f-4594-8be0-c09064f4d878","resolution":{"observed_at":"2026-08-06T22:09:22.671164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02900","last_updated":"2025-07-10T08:33:52Z","snapshot_observed_at":"2026-08-12T23:08:04.493750Z","submitted_at":"2024-08-06T02:09:35Z","title":"MedTrinity-25M: A Large-scale Multimodal Dataset with Multigranular Annotations for Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02900","snapshot_observed_at":"2026-08-06T22:09:09.710112Z","title":"Medtrinity-25m: A large-scale multimodal dataset with multigranular annotations for medicine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.710112Z"},"links":{"cited_paper":"/paper/2408.02900","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:47e126f2b7a452a67a4f01374d8332b4851a1697a49d32d9f42f449b31368ac0","observation_id":"31afff91-5c0d-4f8b-851b-ed573b3c889e","resolution":{"observed_at":"2026-08-06T22:09:09.710112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.357230Z","title":"Multiple instance captioning: Learning representations from histopathol- ogy textbooks and articles","venue":null,"work_id":"bbcbbf4d-88cd-4039-b883-74b8df24d4e4","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.871658Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:e3757103331ecb652150843f801c155b60e7c0606d2ba20ce2cad705ea8e85e6","observation_id":"f531272f-3b18-48de-96df-9085e23663a1","resolution":{"observed_at":"2026-08-06T22:09:22.457135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.207438Z","title":"Slake: A semantically-labeled knowledge-enhanced dataset for medical visual question answering","venue":null,"work_id":"b605324d-6654-406e-b23e-d41097889560","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:09.990786Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f8e04d946511e6bdc05af9754c94f4e6f4bab055b1889aec4b0eeb9f01d98582","observation_id":"6f6749f7-096e-4fa8-966b-5a8782a0958b","resolution":{"observed_at":"2026-08-06T22:09:22.274391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.245863Z","title":"A dataset of clinically generated visual questions and answers about radiology images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.245863Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:6cb56d9ed264d81cb8a73d749730817580c8e8dfaa2b7dc9f78431ecc3516e7d","observation_id":"11183f65-a4c5-4f1f-903c-eb4116cf9cb8","resolution":{"observed_at":"2026-08-06T22:09:10.245863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:22.052470Z","title":"Komura, A","venue":null,"work_id":"0dea7b06-00f3-4ef0-b6cd-ec2019c036e8","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.439304Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:be41c8984e3a394834f2cc1abba6011b9257afa0d37f6e8f4b7de45f8ab23b13","observation_id":"0ecb0056-ea55-4c59-af04-9e4d6b34f5d0","resolution":{"observed_at":"2026-08-06T22:09:22.107874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.652016Z","title":"Bracs: A dataset for breast carcinoma subtyping in h&e histology images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.652016Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:58a9ab552c337abd22fdc391496eae133fc93c80a454451b32c181b5e6c28cc8","observation_id":"bbf17714-4664-4406-b30f-5218fc3c31d0","resolution":{"observed_at":"2026-08-06T22:09:10.652016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.820403Z","title":"The cancer genome atlas pan-cancer analysis project","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.820403Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:dc3f332e5cef689316e6245de18a704d6786854e601fd4e31333b72a4372a619","observation_id":"fd924f54-604b-4b30-9c95-62785afcffdc","resolution":{"observed_at":"2026-08-06T22:09:10.820403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:10.961838Z","title":"Diagnostic assessment of deep learning algorithms for detection of lymph node metastases in women with breast cancer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:10.961838Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:72b13927086ed110dfd0321c0c122e3f8031164be12a0d3c70b9306851acde39","observation_id":"ca579c63-41a6-4486-947e-741c90e9876d","resolution":{"observed_at":"2026-08-06T22:09:10.961838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16671","last_updated":"2025-11-23T00:34:43Z","snapshot_observed_at":"2026-08-02T18:24:11.208164Z","submitted_at":"2023-09-28T17:59:56Z","title":"Demystifying CLIP Data","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16671","snapshot_observed_at":"2026-08-06T22:09:11.105193Z","title":"Demystifying clip data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.105193Z"},"links":{"cited_paper":"/paper/2309.16671","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:57410f4d33c9070bb360701351888a59699806c41def7dfd9808bf3d593d5dc8","observation_id":"77b23275-4cc8-449d-81f8-50d967ded625","resolution":{"observed_at":"2026-08-06T22:09:11.105193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.878826Z","title":"Biomedbert: A pre-trained biomedical language model for qa and ir","venue":null,"work_id":"896dd55e-47b6-4af6-90bb-9e147a17cd1f","year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.289412Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:84a312b2b2e1316c04798a0d01f32d95972c19e7311799187335e666127769ae","observation_id":"dd78bb3d-3da8-46c1-928e-f44c2da9663c","resolution":{"observed_at":"2026-08-06T22:09:21.964830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T22:09:11.477309Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.477309Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:10c6b7c8628f4df63596c7dff6f3b08cc460f5733eefb910e26617ad1c51fc80","observation_id":"c6b7ede0-a432-4f06-b90c-18f489d33a69","resolution":{"observed_at":"2026-08-06T22:09:11.477309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:11.596534Z","title":"Attention-based deep multiple instance learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.596534Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f7a06ad90605b92af3fff2f143c7005499f68bf95ba31590bde23a6f76ecdbf1","observation_id":"f1c1a5d8-fd3f-437f-ba9e-0b4a21a28512","resolution":{"observed_at":"2026-08-06T22:09:11.596534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.697568Z","title":"A vision–language foundation model for precision oncology","venue":null,"work_id":"ac8b92fb-0efa-4cef-ad8c-76e99979180d","year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.754424Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:e731ec0fa260c0443831617ed0a07299fcb6f8dbbffe66d93b464aaa8b900ff9","observation_id":"8cf28a8e-8772-441f-8db8-c26f8aae9520","resolution":{"observed_at":"2026-08-06T22:09:21.790827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.533588Z","title":"Tcga-reports: A machine-readable pathology report resource for benchmarking text-based ai models","venue":null,"work_id":"d39c9032-2b59-4e41-a775-0286b34c9dd6","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:11.905762Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1ad1280c60f47404a387b901e1f1939ae87bf3945a8125390804ab495beb2fab","observation_id":"ee86520d-184e-414c-803f-5686a5b24001","resolution":{"observed_at":"2026-08-06T22:09:21.614850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.377545Z","title":"Covid-net: A tailored deep convolutional neural network design for detection of covid-19 cases from chest x-ray images","venue":null,"work_id":"3feb438a-97b6-4789-8f7b-559cdd0f89b5","year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.027302Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:af2555881997a18ba4d8759f199ed02979e713982933dee34fdf1df623ae1f79","observation_id":"b651ca39-8611-4671-b306-782aae1a5d52","resolution":{"observed_at":"2026-08-06T22:09:21.452514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.211024Z","title":"Philip Kegelmeyer","venue":null,"work_id":"1fc8bda0-3396-4f44-85f6-06d18d1401f7","year":2001},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.136294Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f12e4a0ccae799f012f1de00e013b45039379447b22eeff6fa197e2d193e1efa","observation_id":"8837456a-fe4e-4127-bb77-feeeeb8d22b4","resolution":{"observed_at":"2026-08-06T22:09:21.296841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:12.200307Z","title":"Two public chest x-ray datasets for computer-aided screening of pulmonary diseases","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.200307Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:876a662cc3c04ec7b43c3055ae9456b437674301773329cf9cee214e7ecba36f","observation_id":"02386925-3aa5-4f25-bd87-b652fd40813e","resolution":{"observed_at":"2026-08-06T22:09:12.200307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:21.014161Z","title":"Siim-acr pneumothorax segmentation","venue":null,"work_id":"4841510e-1322-48f1-a6d7-019ca34174b7","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.318478Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:e9f096ecb76b5244e923324db8ebe6ebf8f426b559cab925d029da93b31550ef","observation_id":"aa30a820-7b26-4770-b9ef-90e8fd7baa49","resolution":{"observed_at":"2026-08-06T22:09:21.082885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.816830Z","title":"Augmenting the national institutes of health chest radiograph dataset with expert annotations of possible pneumonia","venue":null,"work_id":"0b9b7e3c-a050-424f-9427-2d3b2424ac56","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.434537Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:9684a518a2a933c64cecad5c051814edb76daeb33ad48e55242d5007b10bd90b","observation_id":"c0a280d7-d35e-4bdb-9c8f-538d9310df59","resolution":{"observed_at":"2026-08-06T22:09:20.923983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.634035Z","title":"Brain Tumor Multimodal Image (CT & MRI)","venue":null,"work_id":"d5a7fc60-dfee-44ea-a57e-03c0037d268d","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.538811Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:ac3500cb92afe3187ab8a06a7dfe23f3d5b14aafa21ac5f9ad06b57ece6ef419","observation_id":"42c27fdf-9b20-413f-b607-899e86b31a1b","resolution":{"observed_at":"2026-08-06T22:09:20.723024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2404.16000","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:16.104435Z","title":"A comprehensive and easy-to-use multi-domain multi-task medical imaging meta-dataset (medimeta)","venue":null,"work_id":"5cf080fd-b41d-408d-aade-211b7b0cdb78","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.676445Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:90c63a2ea3a1510a3833548cde9f699e6df28cbf37a7b2b7f24c5ef8f0e63433","observation_id":"6b1aab37-2bd3-480c-a932-cf8c8d58d882","resolution":{"observed_at":"2026-08-06T22:09:16.178185Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.510644Z","title":"Covid-net ct-2: Enhanced deep neural networks for detection of covid-19 from chest ct images through bigger, more diverse learning","venue":null,"work_id":"f55ea8a9-a1bb-4aa8-9278-3e2f00e27111","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.771523Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5ffe81cc8e4bdd4320aabeb18a1ddf9dcd863d0ee6131a2412c0ef1b5f0324f8","observation_id":"f333df6c-05b5-4940-ac79-5f8651913ba4","resolution":{"observed_at":"2026-08-06T22:09:20.567384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:12.918917Z","title":"Medmnist v2-a large-scale lightweight benchmark for 2d and 3d biomedical image classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:12.918917Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:4a420b93ab524905df8a258a760fcbd386c38c00f5d4ce3d39aa09ea2ff50af1","observation_id":"db636dfa-4579-407c-966b-0135d5977f7e","resolution":{"observed_at":"2026-08-06T22:09:12.918917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.368574Z","title":"Brain tumor mri dataset, 2021","venue":null,"work_id":"48cb761e-0d55-44e4-a34b-0bd8f2ad9ad9","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.058741Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:6f595f180a5d25496d80ad7aed05ffeb3f552b98ad28faa2bee30e50246a2bb1","observation_id":"28ccdc36-53ca-45ff-b104-e78844f16c9c","resolution":{"observed_at":"2026-08-06T22:09:20.439724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.197910Z","title":"Deep-learning-assisted diagnosis for knee magnetic resonance imaging: development and retrospective validation of mrnet","venue":null,"work_id":"d73d8cc5-5d5b-4235-9375-e64c117758a1","year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.169713Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:b08391a87037dd9bc93e06fad50ae4f538ce88c7b809cb8199af39faf88ac51a","observation_id":"7d62a276-cf29-4906-a593-de73f042ff96","resolution":{"observed_at":"2026-08-06T22:09:20.273737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:20.016139Z","title":"Role of inter-and extra-lesion tissue, transfer learning, and fine-tuning in the robust classification of breast lesions","venue":null,"work_id":"60430779-2c23-4e1c-8563-c08341250425","year":2024},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.275608Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3e04a8a02bf56caba354fad6d90912884e0fb2236e509426b7e1c5197ebfc35b","observation_id":"e27df61b-a9eb-42e2-a5b8-a661b5a6da12","resolution":{"observed_at":"2026-08-06T22:09:20.106799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:13.350526Z","title":"Dataset of breast ultrasound images","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.350526Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:10a086d40b00d7f67b713ffb4a92ea196fe44406218ff1ddd78c40967605778f","observation_id":"ed6b850e-401a-48b6-81bd-6a727ce0a25b","resolution":{"observed_at":"2026-08-06T22:09:13.350526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.842686Z","title":"Diabetic retinopathy detection","venue":null,"work_id":"4694bf2e-9598-4df2-9415-d500f2c9a29d","year":2015},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.450785Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f27b1826c4fa2c9da8d0b04d66bc0d4f1426d8c4c59121872a02946948a8af9d","observation_id":"c84ab718-ef60-4d93-abf1-be009433f12d","resolution":{"observed_at":"2026-08-06T22:09:19.923891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.604879Z","title":"Automatic detection of 39 fundus diseases and conditions in retinal photographs using deep neural networks","venue":null,"work_id":"85df50ee-94b8-42ba-b752-87011231135e","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.592486Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:6b643a42914e5b8eb65e5af7bc2a0cb9b39ae24bd7026e3758ef3c44d2d1fe20","observation_id":"7d0803e5-9687-4782-8563-9e3b1d51a1ea","resolution":{"observed_at":"2026-08-06T22:09:19.714171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.392644Z","title":"Fives: A fundus image dataset for artificial intelligence based vessel segmentation","venue":null,"work_id":"6b84f6c8-ec69-460f-85d5-10ba566018a4","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.699525Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:674bcd502af26dbd1d27a5dd728814bc2c2134c4b19e170618c5209558da6eda","observation_id":"d4a918d0-b4f0-43d7-a307-f5464308caa9","resolution":{"observed_at":"2026-08-06T22:09:19.502437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.34740/kaggle/ds","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:15.852949Z","title":"Retinal oct image classification - c8 [data set]","venue":null,"work_id":"55722b41-058a-42b9-99c6-51d7262dfd76","year":2021},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.774826Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1940dbdbda47224e17bfb9e0a41b35d994c93e1f4eb6de8159ef6a3a03f3234b","observation_id":"43b95e6c-1b23-493d-8b1d-9d39ddab78ac","resolution":{"observed_at":"2026-08-06T22:09:15.930294Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.215934Z","title":"Bach: Grand challenge on breast cancer histology images","venue":null,"work_id":"f3aeb944-0d81-46bb-8fba-2b4bec1a7491","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.873657Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5b495aad6d89214c5f30b97060327bc1cf607b4ca6b864fd35e1f80de3b771d4","observation_id":"b9fa17bf-d65e-4589-b522-91aaf1ce44dc","resolution":{"observed_at":"2026-08-06T22:09:19.296259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.12142","last_updated":"2019-12-16T16:28:00Z","snapshot_observed_at":"2026-08-06T07:25:43.205348Z","submitted_at":"2019-12-16T16:28:00Z","title":"Lung and Colon Cancer Histopathological Image Dataset (LC25000)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.12142","snapshot_observed_at":"2026-08-06T22:09:13.976650Z","title":"Lung and colon cancer histopathological image dataset (lc25000)","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:13.976650Z"},"links":{"cited_paper":"/paper/1912.12142","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:4d3b730d6e4eb183aecd77053baba2d9758f160d9fa6e580d86343a5e2b5b2d1","observation_id":"742742e3-5d6f-4aca-b3cb-1e3791f4fcff","resolution":{"observed_at":"2026-08-06T22:09:13.976650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:19.053642Z","title":"100,000 histological images of human colorectal cancer and healthy tissue","venue":null,"work_id":"e2b16a09-dc83-4c03-ba17-5feb3c0f5ed7","year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.050668Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:9b4112b0980f41759817704735f6adafcaae5cd54bd85c1621e70fd74dd044f7","observation_id":"f16b75cb-d657-42c5-88d4-61497ba19e22","resolution":{"observed_at":"2026-08-06T22:09:19.131819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.850378Z","title":"Viable and necrotic tumor assessment from whole slide images of osteosarcoma using machine-learning and deep-learning models","venue":null,"work_id":"0f71eeae-a147-4420-bd44-3d8147455524","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.180280Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:5f8c64b1cb1d81feca02d9a97c817242bbcd646d428593ab2458e3944a5f1811","observation_id":"b8c13085-7bfc-4541-9d6c-99e7edbf6ce6","resolution":{"observed_at":"2026-08-06T22:09:18.956386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.671963Z","title":"Large-scale pretraining on pathological images for fine-tuning of small pathological benchmarks","venue":null,"work_id":"7a99fa44-ccfe-4f14-81d1-a6dd6c42d4b9","year":2023},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.333621Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:1d97276089a58cd3559f0dca5145db20bcc71a039d09dfb9ab4c4a8465f4e77e","observation_id":"ad4742ad-5884-4179-8694-304c34a110c1","resolution":{"observed_at":"2026-08-06T22:09:18.749417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.468409Z","title":"Multi-class texture analysis in colorectal cancer histology","venue":null,"work_id":"ca9d4078-977a-454a-bed8-ecc9c44526c1","year":2016},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.467421Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:0cef5cdaec5990088cc2458b3b9edf20c86000faf19f9130acc2c82598d3296e","observation_id":"06741a13-d982-466e-b7b7-a89ab22eda96","resolution":{"observed_at":"2026-08-06T22:09:18.542159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:18.137513Z","title":"Predicting survival from colorectal cancer histology slides using deep learning: A retrospective multicenter study","venue":null,"work_id":"5e25353d-de44-407f-95a3-1d587018d512","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.593410Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:79207e9e3639145728c26d37d84a4adc53f10cf8b457db6af539fd68f354887d","observation_id":"5b87e978-db3b-4cba-a33e-ccc502280678","resolution":{"observed_at":"2026-08-06T22:09:18.258083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.905534Z","title":"Deep learning for the detection of anatomical tissue structures and neoplasms of the skin on scanned histopathological tissue sections","venue":null,"work_id":"04bfee4a-3f76-4e4c-8acb-340121df0860","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.717861Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:037bc79137c9510885f465be37f6c0daa34aea1ff0bcbb07550327118b88730e","observation_id":"172c08c5-e908-43ef-b367-a56b614a7271","resolution":{"observed_at":"2026-08-06T22:09:18.006071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.617366Z","title":"Interpretable classification of alzheimer’s disease pathologies with a convolutional neural network pipeline","venue":null,"work_id":"fe2e208f-d1e3-46a4-a275-3b5af1ce101b","year":2019},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.844361Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:f8bdfe96267d827a74d3e79a07ce36e0d6edd96e845a8bc6214c1fe99c60f690","observation_id":"d2bdfe87-dd28-4bc8-ae8e-6844d35ef26a","resolution":{"observed_at":"2026-08-06T22:09:17.805711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.400907Z","title":"Deep learning from multiple experts improves identification of amyloid neuropathologies","venue":null,"work_id":"85730b77-fab4-473d-bb94-70f6b6c326ac","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:14.963499Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:399046df37a5f5608e8ffa1dfc7b8aec97c1577c4f9a4a28668d75f3043d3502","observation_id":"d93fc9a5-b44a-4e3d-9dbd-589944d017a7","resolution":{"observed_at":"2026-08-06T22:09:17.527224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:17.159053Z","title":"Kvasir: A multi-class image dataset for computer aided gastrointestinal disease detection","venue":null,"work_id":"589724b6-b267-4e5d-88bb-6e63e552b6a2","year":2017},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.131124Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:0a49c32a8a4408d7d1522e3793cd54f288bcdb7117354e3ca0c13bc5d22d4b55","observation_id":"e0dee7a3-f05a-4ae9-9ea9-5dc87caf7a55","resolution":{"observed_at":"2026-08-06T22:09:17.273052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:16.880138Z","title":"Montalbo","venue":null,"work_id":"d13a45ad-b63c-44f2-845c-53692834be06","year":2022},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.226882Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:06a506bc51214d1fed86b39b790bb24cf7ccc372883bf6bf00b8a752ebef23e8","observation_id":"bacdd138-296e-421a-9888-657aa1946bc9","resolution":{"observed_at":"2026-08-06T22:09:17.013849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:15.369691Z","title":"The ham10000 dataset, a large collection of multi-source dermatoscopic images of common pigmented skin lesions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.369691Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:3f3889155ead33a15ef1270315dd22baf6d9f170f2b713c020076d077a0d33be","observation_id":"7d4321d6-722b-4c8c-933d-b9f1d0a72b40","resolution":{"observed_at":"2026-08-06T22:09:15.369691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:09:16.697623Z","title":"Pad-ufes-20: A skin lesion dataset composed of patient data and clinical images collected from smartphones","venue":null,"work_id":"d3334de3-f8e2-4429-8ad6-7ff914ba900d","year":2020},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.484016Z"},"links":{"citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:ef091a8a00cff6473201b21dacd4ad5c647b172295f597db5f8a5f8187cfdefa","observation_id":"88a57ed3-838c-4a2a-b67d-abc046207477","resolution":{"observed_at":"2026-08-06T22:09:16.789470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T22:09:15.626675Z","title":"Benign\": 0,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:15.626675Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:7b6f6a665563e48ba370c0716019ea9f66617155685b3b2d5adb9500fc46c1c1","observation_id":"4577c7e9-fe2c-46b2-8df2-ad9f69fd8699","resolution":{"observed_at":"2026-08-06T22:09:15.626675Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T19:06:06.437268Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 1 inbound Pith citation observation for arXiv:2506.22567."}