{"as_of":"2026-08-13T04:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db8b9b40bfd69ffb2529c444d53f2408d3dac74080c1b371bb64f05a538a3b56","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:19:33.245710Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.08349/citation-record","integrity":"/paper/2506.08349/integrity","json":"/paper/2506.08349/citation-record.json","paper":"/paper/2506.08349"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-07T05:19:33.126829Z","title":"J., Javaheripi, M., Kauffmann, P., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.126829Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:5f1299975e89f58ceff0c926d0aceb43c3481fc007f3fdc8fd8160d3132e01f2","observation_id":"a78a2827-c586-419e-b5d6-48029857868f","resolution":{"observed_at":"2026-08-07T05:19:33.126829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T05:19:33.130742Z","title":"A., Awan, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.130742Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:77808d9d9c2dd51f8af410261ca935065cfb072d61f670d9a31535214cfbfe0e","observation_id":"baaad06f-1a16-4614-83fb-429004cf21ea","resolution":{"observed_at":"2026-08-07T05:19:33.130742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:19:33.134332Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.134332Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:64004642d102a48208a27520b5cfe4812a885dea04e155fffff0fc8925730ebe","observation_id":"e6fd8e85-c75c-4a90-b8dd-048bf80acbe6","resolution":{"observed_at":"2026-08-07T05:19:33.134332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.591586Z","title":null,"venue":null,"work_id":"29fcbaae-7ab2-41ea-be9e-c0cca99bf113","year":2001},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.138904Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:06debbe3c93a390cf21e2232eb0570ae7cf0c87be065f037aaaf7a5c1ad3d676","observation_id":"e1edc71c-ca9c-4b06-9973-ca92efbb74a8","resolution":{"observed_at":"2026-08-07T05:19:33.594125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T05:19:33.142732Z","title":"M., Hauth, A., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.142732Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:14e14e4664ee776947fff334510605bfd302c6408de334fb808eb756f475c017","observation_id":"73a37a47-5b85-4ec6-8b57-89151924ac1a","resolution":{"observed_at":"2026-08-07T05:19:33.142732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T05:19:33.146797Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.146797Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:85d989200e0320906b988ff6a1582a1cfc7a4429db27ddbf0f1bbbbfabaf9118","observation_id":"b8962460-be4d-4715-a13a-e32a85b439d3","resolution":{"observed_at":"2026-08-07T05:19:33.146797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.584007Z","title":"Overview of the medical question answering task at trec 2017 liveqa","venue":null,"work_id":"a5d4bc53-1556-442d-a6e8-5e14df6705e8","year":2017},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.150105Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:a8227ecac50f34be8aac33d4bb9d9dd5e65d85a8cc48eaa8e85edf438e67019d","observation_id":"a1e12a8d-ce13-4f17-b6a5-19d07d4e3f56","resolution":{"observed_at":"2026-08-07T05:19:33.586684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.576146Z","title":"S., Englehart, M","venue":null,"work_id":"b047de93-8229-4f3c-889f-2e456691a78e","year":1956},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.153164Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:3e528424417abe86e521486ca76da8598a8ff72f137bbddcadf38d17045a9924","observation_id":"e4be78c0-33bf-47be-a4e8-95f3a2c3a249","resolution":{"observed_at":"2026-08-07T05:19:33.578962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.568112Z","title":"The unified medical language system (umls): integrating biomedical terminology","venue":null,"work_id":"67060c98-ef44-4e80-821d-df15e906d0dd","year":2004},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.155904Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:672d06e9101ab89a8dd4bef181e7f007116a7203266c82404911535f20a2e693","observation_id":"5d9070cc-4f18-475a-a428-33118c443882","resolution":{"observed_at":"2026-08-07T05:19:33.571091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.560033Z","title":null,"venue":null,"work_id":"bda91601-c76c-4220-9e2f-0759e180bfb4","year":2020},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.158633Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:03b2fda2f59f3b1a38417fd660497995b882c9d21c429ea783847f63e42c6296","observation_id":"cbc39d3a-86ce-4bad-803a-46ab91b44a48","resolution":{"observed_at":"2026-08-07T05:19:33.562957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i16.29723","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Medbench: A large-scale chinese benchmark for evaluating medical large language models","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"4d4bd7cf-d278-435a-95b1-d253bbcf4d1b","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.161403Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:e2224b95daa449948e7b250e4eb0c1439b610210a91adf1896a40b75994f9787","observation_id":"72be59a9-6e3a-4dc2-bef3-47e54e26ec34","resolution":{"observed_at":"2026-08-07T05:19:33.554631Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16079","last_updated":"2023-11-27T18:49:43Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:49:43Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16079","snapshot_observed_at":"2026-08-07T05:19:33.164270Z","title":"H., Romanou, A., Bonnet, A., Matoba, K., Salvi, F., Pagliardini, M., Fan, S., K \\\"o pf, A., Mohtashami, A., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.164270Z"},"links":{"cited_paper":"/paper/2311.16079","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:e983f16609f26dea46fd775a3a9e2bad3ced81fdceddb3bf512f67c83ef1a677","observation_id":"7b449a13-136e-4b1c-8e37-a8137733ce75","resolution":{"observed_at":"2026-08-07T05:19:33.164270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.543857Z","title":"U., Pimentel, M","venue":null,"work_id":"1a2947c8-8c48-47b0-b1c0-4175ed616222","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.167785Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:49343581219206bed17ab76d55bb8e9462f146e9d8e0c4909cd07549f5cc0b98","observation_id":"8d05d94c-dc3b-458f-b289-ff7c5e008b1b","resolution":{"observed_at":"2026-08-07T05:19:33.546163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06142","last_updated":"2024-08-12T13:37:31Z","snapshot_observed_at":"2026-08-12T23:04:57.569788Z","submitted_at":"2024-08-12T13:37:31Z","title":"Med42-v2: A Suite of Clinical LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06142","snapshot_observed_at":"2026-08-07T05:19:33.170913Z","title":"K., Raha, T., Khan, S., and Pimentel, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.170913Z"},"links":{"cited_paper":"/paper/2408.06142","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:29d788e261d12125a20008941cd29659e5aac616e14ac9a4981c30991d3f0979","observation_id":"9a8cf196-9e57-404c-9580-351919d5c879","resolution":{"observed_at":"2026-08-07T05:19:33.170913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:19:33.173687Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.173687Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:d1b6c6ff2cba11038b7c668ba98e43f805f4de37118d628c779de9908cd70a13","observation_id":"2f11382f-c86c-4fa6-a23b-6ceab1eb99e8","resolution":{"observed_at":"2026-08-07T05:19:33.173687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.536105Z","title":"Evaluation and mitigation of the limitations of large language models in clinical decision-making","venue":null,"work_id":"0164ed91-9cc3-41e7-95db-a839edba07cd","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.176259Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:d3b4a762cfaa9548cbe52210dc1b31bbe2d992fac67c9c70c11c32b6274d69be","observation_id":"105f22a7-a464-4273-91fb-2c2102d96403","resolution":{"observed_at":"2026-08-07T05:19:33.538983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T05:19:33.178782Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.178782Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:4c8d4bc725df16e1681ff8faab1f9e2a65f9fd4a063a890c5e1673ca81c5e8bc","observation_id":"0fcbfc62-bd5c-45bf-aff3-08c2a3a698a8","resolution":{"observed_at":"2026-08-07T05:19:33.178782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.528317Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams","venue":null,"work_id":"f1d1b867-789d-4a34-b8be-1b49314ed09e","year":2021},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.181345Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:073f995516e3c0b44495c77e0629b1deef529ef44e7781645f88794962c703d6","observation_id":"f86ec334-4259-4823-86f7-b98d40e9386d","resolution":{"observed_at":"2026-08-07T05:19:33.531079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.184334Z","title":"P ub M ed QA : A dataset for biomedical research question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.184334Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:69fd0b0511a63e7607f7d0db70fd006be680bb9f029c75772422e9940e70b24b","observation_id":"4c0cd703-4887-4223-9258-4fd8c83a4fd0","resolution":{"observed_at":"2026-08-07T05:19:33.184334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.519613Z","title":"E., Bulgarelli, L., Shen, L., Gayles, A., Shammout, A., Horng, S., Pollard, T","venue":null,"work_id":"390f1686-17ad-41fe-9244-2e163067676f","year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.187420Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:f166620cd7e47b01bb45c5cc8d5d8ff2d2fb0a2bc84275ded52bee3d17c6ef87","observation_id":"eaca3cc6-1e9f-43ff-a53f-6ab39b6068f4","resolution":{"observed_at":"2026-08-07T05:19:33.522628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.511621Z","title":"A., Roberts, A., et al","venue":null,"work_id":"d90f0897-9982-411a-8cbc-c53165989fd6","year":2021},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.190317Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:6d796b49deccaf3f95d959968b1969036d49a4679b9437befe0359635bcd0c91","observation_id":"b9c83da7-d8bd-4a6c-b933-c0c64d238864","resolution":{"observed_at":"2026-08-07T05:19:33.514149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T05:19:33.193159Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.193159Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:b0c9fd97823c7da56ca6b65efd1e132c9e84d73694fc1cf78e228e3091a05f0c","observation_id":"c46d6e30-cdb6-46b1-82cf-70978be20cd9","resolution":{"observed_at":"2026-08-07T05:19:33.193159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T05:19:33.196012Z","title":"S., Love, J., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.196012Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:097c7fead7b075b4fcf66191f9b91775da053db316d7dd3a704cd05f41bd205c","observation_id":"97da048d-0f1c-41db-bd60-efe06806f59d","resolution":{"observed_at":"2026-08-07T05:19:33.196012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13375","last_updated":"2023-04-12T16:48:39Z","snapshot_observed_at":"2026-08-12T12:22:21.685330Z","submitted_at":"2023-03-20T16:18:38Z","title":"Capabilities of GPT-4 on Medical Challenge Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13375","snapshot_observed_at":"2026-08-07T05:19:33.198772Z","title":"M., Carignan, D., and Horvitz, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.198772Z"},"links":{"cited_paper":"/paper/2303.13375","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:d120ed4bd7ef962a6495bb67b3a610cc61f68c0ad2accb87c6bb7827943df364","observation_id":"f6b9cd02-c8d5-4bcd-a317-cb386966799b","resolution":{"observed_at":"2026-08-07T05:19:33.198772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16452","last_updated":"2023-11-28T03:16:12Z","snapshot_observed_at":"2026-08-07T08:26:36.845011Z","submitted_at":"2023-11-28T03:16:12Z","title":"Can Generalist Foundation Models Outcompete Special-Purpose Tuning? Case Study in Medicine","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16452","snapshot_observed_at":"2026-08-07T05:19:33.202015Z","title":"T., Zhang, S., Carignan, D., Edgar, R., Fusi, N., King, N., Larson, J., Li, Y., Liu, W., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.202015Z"},"links":{"cited_paper":"/paper/2311.16452","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:96042ac3d0c6ff3fabd7267c0fff61de66d9bf72a93e6a7bf509241be4fbea10","observation_id":"3cd2eaad-b15f-42f2-bf48-c9c9468ef675","resolution":{"observed_at":"2026-08-07T05:19:33.202015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.503463Z","title":"Gpt-4o mini: advancing cost-efficient intelligence, 2024","venue":null,"work_id":"925e36b8-8df7-4829-b85e-7104cfe74ab4","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.205196Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:706de39cf38dc97f73dae0c37605a98cb49840468276803d21eb950d8f3e5d8e","observation_id":"a5c9893b-15d8-47a0-bc03-e45d70f23d47","resolution":{"observed_at":"2026-08-07T05:19:33.506444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.495481Z","title":"L., Mishkin, P., Zhang, C., Agarwal, S., Slama, K., Ray, A., Schulman, J., Hilton, J., Kelton, F., Miller, L., Simens, M., Askell, A., Welinder, P., Christiano, P","venue":null,"work_id":"47268531-fb56-4f5b-93d9-1b54bad3507c","year":2022},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.207683Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:9079e2850c9010680a5abda8e50ebb379007c3089b11311c61e8726c1adbdf11","observation_id":"c3795670-7509-4275-a135-76acf6b41bc6","resolution":{"observed_at":"2026-08-07T05:19:33.498276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.486706Z","title":"Climedbench: A large-scale chinese benchmark for evaluating medical large language models in clinical scenarios","venue":null,"work_id":"24ae55f9-bd76-464b-b2fb-593ff01f5c1d","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.210803Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:62c848c68ec658b57f347a00f48104602b114bf19d295169c7466d593d4c73f7","observation_id":"bfc94c8e-6edd-48f9-8d71-382c70598620","resolution":{"observed_at":"2026-08-07T05:19:33.489846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.477729Z","title":"K., and Sankarasubbu, M","venue":null,"work_id":"402ac69e-bf47-4147-be5e-ceab03059216","year":2022},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.213449Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:9bbc7c1fc86f474c348f7ff4430e3a6b6376dbaea5fde4a77273cbb54e7efe27","observation_id":"c8987b34-d0f1-4c58-9a8f-96e2a294843f","resolution":{"observed_at":"2026-08-07T05:19:33.480318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.469190Z","title":"Towards building multilingual language model for medicine","venue":null,"work_id":"6001bf9f-38c6-4217-9d5a-2ed40989eaba","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.216322Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:b5a509eb7482392c273844913aedae71b1d4d97424a769ba2426633fc745f3c9","observation_id":"248fa337-d7e6-4676-bf79-384226bffc17","resolution":{"observed_at":"2026-08-07T05:19:33.472154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.460526Z","title":"S., Wei, J., Chung, H","venue":null,"work_id":"2c27ab76-5593-4157-ba19-e815594d5c37","year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.218853Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:9f56ff914d9bf8d5e58b6f1bed6c7db63a1b78cda8786e5675ed940cd9eca8ce","observation_id":"5e131aa7-9c55-476c-9375-e08872162d29","resolution":{"observed_at":"2026-08-07T05:19:33.463569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09617","last_updated":"2023-05-16T17:11:29Z","snapshot_observed_at":"2026-08-03T08:52:05.725675Z","submitted_at":"2023-05-16T17:11:29Z","title":"Towards Expert-Level Medical Question Answering with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09617","snapshot_observed_at":"2026-08-07T05:19:33.221544Z","title":"Towards expert-level medical question answering with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.221544Z"},"links":{"cited_paper":"/paper/2305.09617","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:a3a9442f18fb92f10a2d74c115b4f270fa35065a7ca38632dfd77055feacfa1f","observation_id":"af6a1063-7661-448a-adea-d5ba1c302f63","resolution":{"observed_at":"2026-08-07T05:19:33.221544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T05:19:33.224344Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.224344Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:dfcb0498a69bb04f0f33cc934ddcfb04a5b40d8db9af204ce407e4c45f62d2b7","observation_id":"3ffb2cb6-3710-49b2-8cef-d42da69b3dad","resolution":{"observed_at":"2026-08-07T05:19:33.224344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12031","last_updated":"2023-08-17T17:19:02Z","snapshot_observed_at":"2026-08-11T03:40:40.197001Z","submitted_at":"2023-05-19T23:07:09Z","title":"Clinical Camel: An Open Expert-Level Medical Language Model with Dialogue-Based Knowledge Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12031","snapshot_observed_at":"2026-08-07T05:19:33.227231Z","title":"R., Ba, J., Krishnan, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.227231Z"},"links":{"cited_paper":"/paper/2305.12031","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:cd094b0f46a1c79e1bc9ca6118c40745067ea92d9272f3eb7244fa06988b84bc","observation_id":"8336a65d-d5a4-4049-9261-69fb63164818","resolution":{"observed_at":"2026-08-07T05:19:33.227231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T05:19:33.231310Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.231310Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:ae2468a831d57ec352a29421d25da4799e87c2386878f845746a823124cf5027","observation_id":"0acfdcce-ad1c-497e-8b42-1212f8ceea78","resolution":{"observed_at":"2026-08-07T05:19:33.231310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T05:19:33.234201Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.234201Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:784f9c076395d6f4d0ebf3b852a0cbb3003544994532aac52e7f9818506cfcaa","observation_id":"d8504776-e4c1-4978-96c2-9dc051e9a5e8","resolution":{"observed_at":"2026-08-07T05:19:33.234201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.451375Z","title":"CMB : A comprehensive medical benchmark in C hinese","venue":null,"work_id":"a3cf2d46-0a79-432f-af24-215e1740ef42","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.236963Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:17a919645cef9d39fff586e960d2e4801b2181132802ae3165ebfe308fa5f007","observation_id":"17dcdb23-6cf0-47ba-9eb7-35b378b4663f","resolution":{"observed_at":"2026-08-07T05:19:33.454966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.441576Z","title":"C., Wu, J., and Liu, X","venue":null,"work_id":"b553ba61-c6ef-44bb-a253-711405f62ba8","year":2025},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.239860Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:25b995b68aead06d1234e3c660de7bde4a3cd0d1663601dd7569a833f3623210","observation_id":"ef377819-65cf-4f80-9436-19ae876ac2df","resolution":{"observed_at":"2026-08-07T05:19:33.445187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T05:19:33.242615Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.242615Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:64bd3a520660a0e6447bccbe16c99e4d50ae442d68f5aff805f7a2206f18adaf","observation_id":"02be86c3-a349-4375-a67d-3d21bc6e14cf","resolution":{"observed_at":"2026-08-07T05:19:33.242615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.245710Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.245710Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:fa68176ad783d49a16b7950a3bc09e3599fbf402c62dad0a18752e726e4bdce2","observation_id":"aa18151f-2968-4c77-9337-cd03dc8dcd71","resolution":{"observed_at":"2026-08-07T05:19:33.245710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T19:43:56.989690Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.08349."}