{"as_of":"2026-08-10T11:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ae7db3b28d76ce0aa93048899b87606440344a27503aa8d17d6eb07f1b498bb","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:09.919296Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.15024/citation-record","integrity":"/paper/2505.15024/integrity","json":"/paper/2505.15024/citation-record.json","paper":"/paper/2505.15024"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:16.212622Z","title":"Zero-shot clinical acronym expansion via latent meaning cells","venue":null,"work_id":"0361d465-603f-4552-a115-75a609900832","year":2020},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.255274Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:6300ff5ae45e803f77a3b13e9cfa3f9a974223bea1854836624ac22e5ae2ae52","observation_id":"0f234cfb-0229-43f0-9ac9-6f1a9d51fcfa","resolution":{"observed_at":"2026-08-07T15:29:16.304764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:04.341527Z","title":"Large language models are few-shot clinical information extractors","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.341527Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:d609c5cbc554b7ef7fb23fc1d5333ff127d3b6a07e8253219fe134637932fcbb","observation_id":"99a2bec7-6691-45bd-994a-27d5ecfbbace","resolution":{"observed_at":"2026-08-07T15:29:04.341527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.970928Z","title":"Medical large language models are vulnerable to data-poisoning attacks","venue":null,"work_id":"af9db4cf-7113-41d6-bd61-d6d1e832056f","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.475338Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:cf682480cbaa28a55471cd67426f77990808ab5cca2b2ea26b081282eeef05fb","observation_id":"7c118357-626c-4b5f-940f-a4a17a0a8817","resolution":{"observed_at":"2026-08-07T15:29:16.043076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:04.616679Z","title":"Openbiollms: Advancing open-source large language models for healthcare and life sciences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.616679Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:608c438f3d90575e1d97ffa10cbf5f4d10d8b74f3f3a2effc4f46dac9d8db1ac","observation_id":"458256da-4ca2-4769-98e0-578be6d31f5f","resolution":{"observed_at":"2026-08-07T15:29:04.616679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04573","last_updated":"2024-12-05T19:35:41Z","snapshot_observed_at":"2026-08-08T01:37:12.821420Z","submitted_at":"2024-12-05T19:35:41Z","title":"Give me Some Hard Questions: Synthetic Data Generation for Clinical QA","version":1},"cited_work":{"arxiv_id":"2412.04573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04573","snapshot_observed_at":"2026-08-07T15:29:10.912373Z","title":"Give me Some Hard Questions: Synthetic Data Generation for Clinical QA","venue":"cs.CL","work_id":"d6b15dc4-439c-44f6-8d72-83e4bee2e77f","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.745921Z"},"links":{"cited_paper":"/paper/2412.04573","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e88f5c8d1c8b6d300a4cb223f91a5bf2abab62710a728148b46b1097af22d996","observation_id":"ff145259-2474-4035-8eaa-453546d21e06","resolution":{"observed_at":"2026-08-07T15:29:11.051626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:04.875050Z","title":"Testing and evaluation of health care applications of large language models: a systematic review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.875050Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:dec3da8a2229767475574a403ca43c995c8cdf15652a058f696101c59d13c64b","observation_id":"fef211be-f041-4639-9482-fe8f1c5f8b8d","resolution":{"observed_at":"2026-08-07T15:29:04.875050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05506","last_updated":"2024-06-24T23:17:52Z","snapshot_observed_at":"2026-08-09T02:25:59.727821Z","submitted_at":"2024-05-09T02:33:14Z","title":"Cross-Care: Assessing the Healthcare Implications of Pre-training Data on Language Model Bias","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05506","snapshot_observed_at":"2026-08-07T15:29:05.026476Z","title":"Cross-care: Assessing the healthcare implications of pre-training data on language model bias","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.026476Z"},"links":{"cited_paper":"/paper/2405.05506","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:cd4e7cd19c68d59facd40a8370a7e3ff5f5144deb1d1097e2de5ceb069430bff","observation_id":"f556a6e8-17ee-4aab-8096-c8549633b3bb","resolution":{"observed_at":"2026-08-07T15:29:05.026476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16079","last_updated":"2023-11-27T18:49:43Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:49:43Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16079","snapshot_observed_at":"2026-08-07T15:29:05.169117Z","title":"Meditron-70b: Scaling medical pretraining for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.169117Z"},"links":{"cited_paper":"/paper/2311.16079","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:f9d8c0df11c8f6a3eafdd8b2022a436ba528c2fa9809373c308a9ecdb10549d6","observation_id":"7a565fea-87e9-431b-9a14-cf70f44e078d","resolution":{"observed_at":"2026-08-07T15:29:05.169117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06142","last_updated":"2024-08-12T13:37:31Z","snapshot_observed_at":"2026-08-08T10:02:05.972661Z","submitted_at":"2024-08-12T13:37:31Z","title":"Med42-v2: A Suite of Clinical LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06142","snapshot_observed_at":"2026-08-07T15:29:05.268413Z","title":"Med42-v2: A suite of clinical llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.268413Z"},"links":{"cited_paper":"/paper/2408.06142","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:d42ccfd43721374d5b42ebd19804f16d4d3574d2d1249d41521c790bf997b992","observation_id":"eda3edaf-b7f7-44a1-8d7d-34eec76cafa3","resolution":{"observed_at":"2026-08-07T15:29:05.268413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.379176Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.379176Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:0e3d8d9d599a7dacc792b19ac681981863822b1de562869f043fe5db4afe9dba","observation_id":"55c9f203-4b69-4d08-b725-6fb1f15a246c","resolution":{"observed_at":"2026-08-07T15:29:05.379176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08758","last_updated":"2021-09-30T17:20:01Z","snapshot_observed_at":"2026-08-03T11:31:09.198404Z","submitted_at":"2021-04-18T07:42:52Z","title":"Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08758","snapshot_observed_at":"2026-08-07T15:29:05.493446Z","title":"Documenting large webtext corpora: A case study on the colossal clean crawled corpus","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.493446Z"},"links":{"cited_paper":"/paper/2104.08758","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e3937befc4052542a87c4c45f216b0e3c4f27997566fe4fba92335931ba10d4e","observation_id":"528baf99-34de-4f92-85f1-9a62ee7c0396","resolution":{"observed_at":"2026-08-07T15:29:05.493446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:29:05.604207Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.604207Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:262ae1767c9997b31aa8ed9db8959a6c8ac71161313f76969b067b269ae7fb77","observation_id":"a54525d7-39c3-4dd5-a023-af536ba65c14","resolution":{"observed_at":"2026-08-07T15:29:05.604207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20707","last_updated":"2024-03-05T20:02:31Z","snapshot_observed_at":"2026-08-09T06:57:55.062530Z","submitted_at":"2023-10-31T17:59:38Z","title":"What's In My Big Data?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20707","snapshot_observed_at":"2026-08-07T15:29:05.747482Z","title":"What's in my big data? arXiv preprint arXiv:2310.20707, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.747482Z"},"links":{"cited_paper":"/paper/2310.20707","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:763277a86dc011a2b23fbd6f2f6f23f7263988e5a46869326723228f6789ec67","observation_id":"417c29a1-1790-48b0-841d-b33fb7f82d99","resolution":{"observed_at":"2026-08-07T15:29:05.747482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.892549Z","title":"Language models are surprisingly fragile to drug names in biomedical benchmarks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.892549Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:eadf08528ec3f63e611a9e8bd8bc8bca809f99a89427a11c892bc59c3047cc12","observation_id":"06020078-e330-4d7f-b11c-206d8adcae3e","resolution":{"observed_at":"2026-08-07T15:29:05.892549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T15:29:05.982964Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.982964Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:6e3d077e3bcd46a7bad06a8ec466679d81288c9756c6aac1e1425c8c40196e1d","observation_id":"b97d4c36-2a4c-47fc-a8b2-3c0d2fabae84","resolution":{"observed_at":"2026-08-07T15:29:05.982964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-07T15:29:06.046507Z","title":"Olmo: Accelerating the science of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.046507Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:0109f60636dbf63a32b79cf7fd60b70fc80bc8d2a6c7c017988b564d529d3151","observation_id":"c403848a-0623-4401-8f01-6895e11b1eb6","resolution":{"observed_at":"2026-08-07T15:29:06.046507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-08-09T11:08:40.708986Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-07T15:29:06.156921Z","title":"Studying large language model generalization with influence functions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.156921Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:5b2ac9b257f09480aa18d0eb5eb81274a874c945bc41c995d02571bc1acf5ad2","observation_id":"1a74ded9-6b21-4a29-b9a2-cb912f8cbea5","resolution":{"observed_at":"2026-08-07T15:29:06.156921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-07T23:01:40.564640Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-08-07T15:29:06.242115Z","title":"Medalpaca--an open-source collection of medical conversational ai models and training data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.242115Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:9391609998819788e3624b273a47a87a0e22ff28bf73660be27122e9c9650d21","observation_id":"e4edb8e6-236e-41c2-933c-94c03b17d46b","resolution":{"observed_at":"2026-08-07T15:29:06.242115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01491","last_updated":"2021-06-02T22:12:39Z","snapshot_observed_at":"2026-08-10T01:18:50.560111Z","submitted_at":"2021-06-02T22:12:39Z","title":"MedNLI Is Not Immune: Natural Language Inference Artifacts in the Clinical Domain","version":1},"cited_work":{"arxiv_id":"2106.01491","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.01491","snapshot_observed_at":"2026-08-07T15:29:10.569623Z","title":"MedNLI Is Not Immune: Natural Language Inference Artifacts in the Clinical Domain","venue":"cs.CL","work_id":"7e7636d0-a4e3-4c3e-a21f-440c773c6e8d","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.348602Z"},"links":{"cited_paper":"/paper/2106.01491","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:c0eee8c845653846b9833ddcf1db91fba55b4f04e98959300811d1b1ffd9c13d","observation_id":"30189382-66f0-4b84-ba5f-302319c7f16e","resolution":{"observed_at":"2026-08-07T15:29:10.660958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04118","last_updated":"2024-11-19T20:51:58Z","snapshot_observed_at":"2026-08-02T05:04:11.160645Z","submitted_at":"2024-11-06T18:51:02Z","title":"Medical Adaptation of Large Language and Vision-Language Models: Are We Making Progress?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04118","snapshot_observed_at":"2026-08-07T15:29:06.447607Z","title":"Medical adaptation of large language and vision-language models: Are we making progress? arXiv preprint arXiv:2411.04118, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.447607Z"},"links":{"cited_paper":"/paper/2411.04118","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:184e78f184643245049aea6b191f4144c9a516f308ecb77a75688085fe65a13c","observation_id":"8c4f91dd-35ba-4664-946b-e4ecebe47a3c","resolution":{"observed_at":"2026-08-07T15:29:06.447607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08870","last_updated":"2025-06-28T21:17:10Z","snapshot_observed_at":"2026-08-06T10:33:54.624795Z","submitted_at":"2024-11-13T18:50:13Z","title":"The Limited Impact of Medical Adaptation of Large Language and Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08870","snapshot_observed_at":"2026-08-07T15:29:06.507433Z","title":"The limited impact of medical adaptation of large language and vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.507433Z"},"links":{"cited_paper":"/paper/2411.08870","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:5d9b92a00fe46493e691bacec50b11c62d465f7d6882b0ca75985fed05cd4528","observation_id":"57fefea6-580c-43d7-9e02-6859db2b4497","resolution":{"observed_at":"2026-08-07T15:29:06.507433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:06.662833Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.662833Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:da377fb8eab86da575944b0a1cce655cf801fdcecbde51ff8d68f193b23792cf","observation_id":"fb725992-b5eb-4d1e-b1a1-fb34eb9a537c","resolution":{"observed_at":"2026-08-07T15:29:06.662833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.666835Z","title":"Matching patients to clinical trials with large language models","venue":null,"work_id":"6c22e9d3-8daa-4c9d-8395-11b07daba11f","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.752942Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:1be67a84194014988e0110136c9193d9d08d8cd11d71bad73b22ddd154ff104a","observation_id":"64c726d0-4cdd-46f6-a77f-bb8f2e0ca4d3","resolution":{"observed_at":"2026-08-07T15:29:15.803447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.391070Z","title":"Mimic-iii","venue":null,"work_id":"1d6df837-9c64-453f-a1cf-d43be1e28655","year":2016},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.837072Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:c7c11ac2f824a83821b4c9c1dda3cead93bb26a50ced798f246b0f6daa10cef3","observation_id":"1ead9fe5-3817-411d-be2f-5b0aa66b4eef","resolution":{"observed_at":"2026-08-07T15:29:15.520427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.123750Z","title":"Mimic-iv","venue":null,"work_id":"0698d044-2821-4c8e-bd84-89cdff228eac","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.918535Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:05b705a66c68f3e130760b4327a6ffb6b46b8966ea21b12d78b120472a337de7","observation_id":"15ffc71a-bc0d-4e2b-bee2-69f2ddb0d37c","resolution":{"observed_at":"2026-08-07T15:29:15.250248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.852142Z","title":"Mimic-iii, a freely accessible critical care database","venue":null,"work_id":"69c518f0-2450-448e-9316-eafbf9e82ddf","year":2016},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.991294Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:8283d0856950fd66b57937647492e998f73a41a1938a62d1d29234d571851fcd","observation_id":"708b237c-f1dd-484d-8bbb-10c6d554fe39","resolution":{"observed_at":"2026-08-07T15:29:14.970322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.060881Z","title":"Mimic-cxr, a de-identified publicly available database of chest radiographs with free-text reports","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.060881Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:937fe377954c9cc3888b5c66eb6e02fa6783e8fd2daacf6df4b0fb9f4a5ae2ba","observation_id":"447fe995-6908-4da1-98e9-c96bcdb23930","resolution":{"observed_at":"2026-08-07T15:29:07.060881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.131567Z","title":"Mimic-iv, a freely accessible electronic health record dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.131567Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:5a6b0e77d9ce710055d1eba0034b937eb60dd3b1543d70160f5eab60823f6b65","observation_id":"ae0ea4dc-eb55-4283-abd5-c5356397d8fb","resolution":{"observed_at":"2026-08-07T15:29:07.131567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.568784Z","title":"Large language models struggle to learn long-tail knowledge","venue":null,"work_id":"66350a65-785f-409c-b6e7-fd5794992db6","year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.276988Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:2c2b3fa83fb8830e890fb4ec03204b3b8b6afac4c8750c5028d986a81fe20bf1","observation_id":"15588577-92b1-486f-9f85-28b44b5d0892","resolution":{"observed_at":"2026-08-07T15:29:14.704615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.320753Z","title":"Debunking health fake news with domain specific pre-trained model","venue":null,"work_id":"cefb97a4-0dcd-4cc9-880d-c2d56d70853f","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.387646Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:7dad7dda3cc3982df8610adb40765ae340a1cfe8ab85774d2f054c29775b2792","observation_id":"148aae8c-38df-421b-9740-7b5f159d9553","resolution":{"observed_at":"2026-08-07T15:29:14.430165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10822","last_updated":"2024-06-06T21:58:49Z","snapshot_observed_at":"2026-07-06T17:45:35.519457Z","submitted_at":"2024-03-16T06:18:15Z","title":"Can Large Language Models abstract Medical Coded Language?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10822","snapshot_observed_at":"2026-08-07T15:29:07.575990Z","title":"Can large language models abstract medical coded language? arXiv preprint arXiv:2403.10822, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.575990Z"},"links":{"cited_paper":"/paper/2403.10822","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:9c6172294623a3a5dc130cf5db76c0a7ef59ce2dba58bf8811895512b1160282","observation_id":"be032bd8-70cb-44a5-85ad-cff94c8f0106","resolution":{"observed_at":"2026-08-07T15:29:07.575990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03066","last_updated":"2024-05-22T16:57:56Z","snapshot_observed_at":"2026-08-07T20:30:35.208804Z","submitted_at":"2024-05-05T22:21:15Z","title":"A scoping review of using Large Language Models (LLMs) to investigate Electronic Health Records (EHRs)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03066","snapshot_observed_at":"2026-08-07T15:29:07.705427Z","title":"A scoping review of using large language models (llms) to investigate electronic health records (ehrs)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.705427Z"},"links":{"cited_paper":"/paper/2405.03066","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:ccfda8a7568c945c5f0b7a67be4ddee79f28be8ecca5649c2ef13ebb7ca12d9d","observation_id":"653ef47e-371b-4dd2-9225-be2b3b0049d9","resolution":{"observed_at":"2026-08-07T15:29:07.705427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05845","last_updated":"2024-12-08T07:52:17Z","snapshot_observed_at":"2026-07-06T20:03:25.000927Z","submitted_at":"2024-12-08T07:52:17Z","title":"Are Clinical T5 Models Better for Clinical Text?","version":1},"cited_work":{"arxiv_id":"2412.05845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05845","snapshot_observed_at":"2026-08-07T15:29:10.180060Z","title":"Are Clinical T5 Models Better for Clinical Text?","venue":"cs.CL","work_id":"d063777d-f470-4516-80e2-895d2d6777a4","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.815853Z"},"links":{"cited_paper":"/paper/2412.05845","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e4b94f76fc3e4d89296719611c769f745cdb915f6fae1022c5f8362a37a24f56","observation_id":"33b18d1d-f2a8-472d-8408-a8a9248a7f85","resolution":{"observed_at":"2026-08-07T15:29:10.339675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17377","last_updated":"2025-04-07T17:59:50Z","snapshot_observed_at":"2026-08-08T02:05:38.594754Z","submitted_at":"2024-01-30T19:03:49Z","title":"Infini-gram: Scaling Unbounded n-gram Language Models to a Trillion Tokens","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17377","snapshot_observed_at":"2026-08-07T15:29:07.971245Z","title":"Infini-gram: Scaling unbounded n-gram language models to a trillion tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.971245Z"},"links":{"cited_paper":"/paper/2401.17377","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:0befbdd18060a8fc421f88a2f997963b452cfc6e2e84668acec8e891c4a54013","observation_id":"f4c6fef2-e7be-4481-bff0-f80443ce7a4a","resolution":{"observed_at":"2026-08-07T15:29:07.971245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02782","last_updated":"2020-07-07T00:40:21Z","snapshot_observed_at":"2026-07-06T08:35:20.515972Z","submitted_at":"2019-11-07T07:34:43Z","title":"S2ORC: The Semantic Scholar Open Research Corpus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02782","snapshot_observed_at":"2026-08-07T15:29:08.141224Z","title":"S2orc: The semantic scholar open research corpus","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.141224Z"},"links":{"cited_paper":"/paper/1911.02782","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:a2a36cb394c9aa3491d5d82257649be35deeb47173abf9c588e6ebafe56f22a0","observation_id":"61f82fdf-f356-469a-8257-6f9df144236c","resolution":{"observed_at":"2026-08-07T15:29:08.141224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.080335Z","title":"Fake or real news about covid-19? pretrained transformer model to detect potential misleading news","venue":null,"work_id":"0b2bdbcd-f0a6-4e63-999d-7088f8b63083","year":2022},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.270161Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:6ccfb7558b3aea42faa90bf81419fe784caa1608c5802aa611f8afe7bf39d51a","observation_id":"ee845d4b-4873-41eb-a54d-0dac2eaf1635","resolution":{"observed_at":"2026-08-07T15:29:14.211578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.821631Z","title":"Evaluating base and retrieval augmented llms with document or online support for evidence based neurology","venue":null,"work_id":"b67de047-0a35-4035-a710-3ed854304b9c","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.439994Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:1f5c352d2709a013286873bc72331525d67b2054d719f9d2b01572a28ede587a","observation_id":"39aebfe4-fe93-4230-9a19-b669f314f29f","resolution":{"observed_at":"2026-08-07T15:29:13.930293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.557711Z","title":"A sense inventory for clinical abbreviations and acronyms created using clinical notes and medical dictionary resources","venue":null,"work_id":"35f8400b-7ad3-43f7-93cf-6a3901115746","year":2014},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.670802Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:34ce4a4c015761bb87662cdde6cfed98af7ed82bd6eb972a91623f576ae914be","observation_id":"be301167-7843-4da7-b25f-917dcacc47cc","resolution":{"observed_at":"2026-08-07T15:29:13.713212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.762683Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.762683Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:b26952c8d803eeece340d2760fb225aae03a05b6e86061d9add47505a6be7cf5","observation_id":"f7be1418-3c17-424e-a2e6-f961bb21df58","resolution":{"observed_at":"2026-08-07T15:29:08.762683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.240813Z","title":"It’s time to bench the medical exam benchmark, 2025","venue":null,"work_id":"118a0d43-2914-4aed-b530-4a0a3f0579f0","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.811657Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e153b4ffe1fc9628733dd1949e855410284f867b3851a650ef103961280524fd","observation_id":"894cd7eb-1a9f-44c2-8e7b-bc09b43356d2","resolution":{"observed_at":"2026-08-07T15:29:13.382004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00159","last_updated":"2024-06-06T18:46:40Z","snapshot_observed_at":"2026-08-08T04:07:59.311599Z","submitted_at":"2024-01-31T20:29:50Z","title":"Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00159","snapshot_observed_at":"2026-08-07T15:29:08.866790Z","title":"Dolma: An open corpus of three trillion tokens for language model pretraining research","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.866790Z"},"links":{"cited_paper":"/paper/2402.00159","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:eec3ef8aadb3a1f596225484cc5ef5c2adbc4493a54bca97e21010a0ddc6a3cf","observation_id":"a347fdee-7fcc-44c3-b722-f201398a60c4","resolution":{"observed_at":"2026-08-07T15:29:08.866790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.971541Z","title":"Large language models are poor medical coders—benchmarking of medical code querying","venue":null,"work_id":"71c84d3c-b786-4046-a8a3-310e57737f50","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.908349Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:d51a79cfb34a41e32b518bded4ff72cd7371756109a90e25b8712dbbe56dd58b","observation_id":"ea42f37f-58f0-4161-8ec9-877c62f6a4c8","resolution":{"observed_at":"2026-08-07T15:29:13.086715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.703251Z","title":"Prevalence of health misinformation on social media: systematic review","venue":null,"work_id":"15433afc-748b-41cf-b996-f4e0b482fd37","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.958235Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:050aa92c796849738981645b5e77202c330f83012693393bb112ae9ace54516c","observation_id":"193c298b-b779-4c74-b865-d7a5a3faf2d5","resolution":{"observed_at":"2026-08-07T15:29:12.805583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.010126Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.010126Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:b32503fcd0dfa0082262e0406da561d65457eaaa6a07fbfa5d7a1b0e44bc15fb","observation_id":"af328636-6b24-405d-9a08-3d00738c805d","resolution":{"observed_at":"2026-08-07T15:29:09.010126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.437596Z","title":"RedPajama: An Open Source Recipe to Reproduce LLaMA training dataset , April 2023","venue":null,"work_id":"778f5f0a-9faa-42c7-9a3a-3819dd6136bd","year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.060653Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:5dfe68e7db057920081eb751ea13b86ecba6af7f0337506bfa0c177cbc1f2196","observation_id":"3a2facdc-cb21-47dd-a922-6f946dbfdd1b","resolution":{"observed_at":"2026-08-07T15:29:12.585008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.185355Z","title":"Clinical camel: An open-source expert-level medical language model with dialogue-based knowledge encoding","venue":null,"work_id":"8aa486fc-c401-43a5-a719-2dfaad00b3dd","year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.113476Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:fd6b9b6dbe47d023b222fca793da6d30dfbb1f7d53fcb07bca721c93f907b7cd","observation_id":"89ef4626-a47c-4e1d-9043-a7fe80bfdc97","resolution":{"observed_at":"2026-08-07T15:29:12.321384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:29:09.166078Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.166078Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:2d1d11f92e9e6f4c7a03ab8d84eef21e5f7a336d8bee2206a47ae59b7f1515ff","observation_id":"ba398e54-45e0-46dc-ac6d-267c68b11eaf","resolution":{"observed_at":"2026-08-07T15:29:09.166078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.948756Z","title":"Adapted large language models can outperform medical experts in clinical text summarization","venue":null,"work_id":"a18f9c01-bce8-4d62-aa7b-2136044a6a43","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.232187Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:60a9aa3ff407f4d7f32bfae8c1d75e26872b9f7a5f782890101907853ccabb5f","observation_id":"84648d4e-e3ab-4a3a-a53f-5a37f9bda00b","resolution":{"observed_at":"2026-08-07T15:29:12.050114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12372","last_updated":"2024-11-19T09:35:28Z","snapshot_observed_at":"2026-08-06T21:35:45.662025Z","submitted_at":"2024-11-19T09:35:28Z","title":"RedPajama: an Open Dataset for Training Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12372","snapshot_observed_at":"2026-08-07T15:29:09.304268Z","title":"Redpajama: an open dataset for training large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.304268Z"},"links":{"cited_paper":"/paper/2411.12372","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:baebd010380e560ac8880069cff23510f88e2b59a8fef45d96294eb9ef64e6f2","observation_id":"4824c5f2-d689-44d9-b29b-4d9ac1db0003","resolution":{"observed_at":"2026-08-07T15:29:09.304268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.660186Z","title":"Me-llama: Foundation large language models for medical applications","venue":null,"work_id":"c456b43b-a163-45bf-ace4-78ed1ab70d54","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.452087Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:a72abacbcd678397bb7fe2ef95d6ead45c0d8070c62f0d751befa65737ac08d7","observation_id":"94fb0127-bc3f-49c5-8a98-afb4e78a4432","resolution":{"observed_at":"2026-08-07T15:29:11.787914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.411527Z","title":"Almanac—retrieval-augmented language models for clinical medicine","venue":null,"work_id":"2f5be607-cbc8-4b2d-a882-4771ac0ebbb2","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.631319Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:f754e89e8708a7543f0d578fbd1afb251448063568b6e3ea0b21fa4437609194","observation_id":"206aacf5-94cc-47cd-84a1-69a23639e6fb","resolution":{"observed_at":"2026-08-07T15:29:11.516515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.181098Z","title":"A dataset for evaluating clinical research claims in large language models","venue":null,"work_id":"3810bc24-158c-4781-b250-1927bffdf695","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.803009Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e3378fd546eee8b4fd685e99adc038bbfd232f7f22a853928f85bc8e6ced1966","observation_id":"14102550-5392-445e-a5c8-6da14551a5b1","resolution":{"observed_at":"2026-08-07T15:29:11.295105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.919296Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.919296Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e2b6cd5920d3af987498daca333829de6dbad42279d4509f7a000d0176e179be","observation_id":"d3e7985a-3312-49a9-98c1-2a3fbbba001c","resolution":{"observed_at":"2026-08-07T15:29:09.919296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T14:19:48.325090Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":3,"verified_fuzzy":20},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.15024."}