{"as_of":"2026-08-11T19:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ce1741f01240506c371d23ef8038d14083ec31b9e74b72645520b5462bd2388","coverage":[{"denominator":108,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T05:10:02.941396Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:25:11.457757Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10286","snapshot_observed_at":"2026-07-14T06:30:16.612345Z","title":"Agentrx: A benchmark study of llm agents for multimodal clinical prediction tasks.arXiv preprint arXiv:2605.10286, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11175","last_updated":"2026-07-13T07:16:50Z","snapshot_observed_at":"2026-07-16T23:19:14.481825Z","submitted_at":"2026-07-13T07:16:50Z","title":"The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy","version":1},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-07-14T06:30:16.612345Z"},"links":{"cited_paper":"/paper/2605.10286","citing_paper":"/paper/2607.11175"},"observation_digest":"sha256:062eb57eef3b77c86dc8fa5661d2d3487704c263f2c8161ef394e483d3ef77c5","observation_id":"8453a3f8-b7b9-43d6-8e4d-98d4a510b9fd","resolution":{"observed_at":"2026-07-14T06:30:16.612345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10286","snapshot_observed_at":"2026-08-03T00:25:11.457757Z","title":"arXiv preprint arXiv:2605.10286 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28802","last_updated":"2026-07-30T19:55:14Z","snapshot_observed_at":"2026-08-08T06:19:07.682563Z","submitted_at":"2026-07-30T19:55:14Z","title":"Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-03T00:25:11.457757Z"},"links":{"cited_paper":"/paper/2605.10286","citing_paper":"/paper/2607.28802"},"observation_digest":"sha256:6405f5e0de49f82ef2fa4220a4d867be6de0ba1681eae01ee2f6f3f0ee95f962","observation_id":"135a7814-95d7-487d-8dd8-857f1181faa7","resolution":{"observed_at":"2026-08-03T00:25:11.457757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.10286/citation-record","integrity":"/paper/2605.10286/integrity","json":"/paper/2605.10286/citation-record.json","paper":"/paper/2605.10286"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv.org , author =","venue":null,"work_id":"1060fa84-2653-44ae-9ced-69f997c46ae0","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:0cb04f5c5207f18a37e3510f851e0a29025b449797a472353886a6c4f9b51991","observation_id":"8590c3d1-714f-49e5-838f-229059352c8a","resolution":{"observed_at":"2026-05-12T12:06:33.835066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv.org , author =","venue":null,"work_id":"62db2499-347c-4058-bab0-9f7c658b0941","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:12a2a1c8ee730fc626b0da68f9faa31f16f2e0579fa2d72cfc8eada4bb57cbf7","observation_id":"4eab7724-d9e2-4baf-83f9-0af0fd9caa07","resolution":{"observed_at":"2026-05-12T12:06:33.832517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv.org , author =","venue":null,"work_id":"ba588015-1a4d-4cd4-9c43-74f92acf4874","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:f04dcdcfc0f2656beffffe24ce5523f5261ebd7276c2474353eccee08bb0bc0a","observation_id":"ddbf4b11-3073-48db-af19-6805e8da5973","resolution":{"observed_at":"2026-05-12T12:06:33.829683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:43:52.650751Z","title":null,"venue":null,"work_id":"f4bbd9ca-27d6-4233-87a2-70d2440ee996","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b9c582d2d996a870c0f8739dc2ce664f32061735d4720f81b6ecc756a0110958","observation_id":"c7a09e7e-a47b-4673-8684-1e5cd8aa8f21","resolution":{"observed_at":"2026-05-12T12:06:33.827187Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Gupta, Vinayak and Althoff, Tim and Hartvigsen, Thomas , month = dec, year =","venue":null,"work_id":"abfe5dbd-4f25-47cc-ae0f-4c75c279ec1c","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:c35f70c8cfa12f60adb5a0786e103110802f24c3424efd0fcef7e67e7f9f50de","observation_id":"7d666398-47d7-46fb-8c6f-ff6adf067ccf","resolution":{"observed_at":"2026-05-12T12:06:33.786837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8c3781f7-c771-45e2-99b6-4fa9ddae0f77","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:2ced841f5b7a879240d268138b977574c49374f229517244753772d569ae3b22","observation_id":"d2c00a8e-21e0-4ebf-9a83-14e8b5e0d1c2","resolution":{"observed_at":"2026-05-12T12:06:33.760461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 41st","venue":null,"work_id":"1cad4503-0619-41ae-9c4d-609cd3150b3a","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:7ee735252646c0c290e92c1dbe6d0e1c4661822c5bab349809fb58a670998ec1","observation_id":"65402a0d-98ee-4daa-855c-bfdd48ccf726","resolution":{"observed_at":"2026-05-12T12:06:33.784135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 10th Machine Learning for Healthcare Conference , year =","venue":null,"work_id":"d5dee587-c1aa-4d2f-b01b-fa1c54f4f6fe","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:8e08c0c90ac5172c4d49fb00fbd319f795aa45d0e013d90be36eac05d807be90","observation_id":"f76aad0a-1487-4909-a43a-1d2b70b8900e","resolution":{"observed_at":"2026-05-12T12:06:33.767612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Shamout, Farah E","venue":null,"work_id":"2c051b01-5a3c-4d23-922e-f0fff8509139","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:c7caf95d9ebf5d2adadf5177062fb00540c0f3e64119d5d8caf7a809fee9035b","observation_id":"dfe0edfd-a566-4238-b994-6038f4a86492","resolution":{"observed_at":"2026-05-12T12:06:33.765194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.165913","doi":"10.3389/fdgth.2025.1659134","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Artsi, V","venue":"Frontiers in Digital Health","work_id":"738ee2aa-9e2c-4626-bf00-ac1977b1b927","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b48e6261973b20c701a2b8b0e807ea4aecf4aa3ded1e93fe5353dc0005f71eec","observation_id":"956986e3-92d4-40fa-9177-428da5858d64","resolution":{"observed_at":"2026-05-12T05:11:21.766348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 38th","venue":null,"work_id":"e6e2a4bd-ed06-46ad-a359-ebad3ccbfd19","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:7c7ebda3a53dfffda4da156f7139b3e24a2957900897aca4ccdde94a06b8e566","observation_id":"2f205b71-3d31-42c5-bb6b-166afd34f280","resolution":{"observed_at":"2026-05-12T12:06:33.778888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.infoh.2025.03.001","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Informatics and Health , author =","venue":"Informatics and Health","work_id":"08dfc747-0477-4b52-b8b9-bee5f61ad9d6","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:ad36738b60d91b9b2134fd162ca9b00a4edd66eb247776d7e42a75de8e4cb7b3","observation_id":"cccb34cb-fa14-4b40-84f8-1aefc7e7f144","resolution":{"observed_at":"2026-05-12T05:11:21.966505Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-82150-9_13","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Intelligent Systems and Pattern Recognition","venue":"Communications in computer and information science","work_id":"7aecdd8a-8112-4657-9eda-6dab68591833","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5df4e8834aea9e5bdd4021e828f8f3d0dcce34a32d992d6f3944ca9534eedcf1","observation_id":"4ebe1f57-2ff1-4135-a8a4-5ad1fd229787","resolution":{"observed_at":"2026-05-12T05:11:21.937555Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv.org , author =","venue":null,"work_id":"fb315cf4-b924-422b-813c-b7aaa5f26b0a","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:6b585f166dfcf6e514556cce2425a6967624f95eb75fee083d8be88d6f7fb537","observation_id":"fc7da582-45dd-41c5-9bd7-12f8a38694a1","resolution":{"observed_at":"2026-05-12T12:06:33.799859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv.org , author =","venue":null,"work_id":"b9573476-fb53-4dd4-84cd-a62d02e14e6b","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:68f42aeee110c7ce1faaae72c3fe003da265f9a81ce2f5332c9ff256b59d3253","observation_id":"54b51020-f2fd-410b-9653-cd87c3bb3286","resolution":{"observed_at":"2026-05-12T12:06:33.791673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:46:07.034683Z","title":"and Le, Quoc V","venue":null,"work_id":"80866b29-3149-4a5d-942a-2db7ee14ea53","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:7dd9e63c82166bb6b24f30fb4c110d65fa34bc5444041c628c8aea2d4e01778c","observation_id":"8af205ca-e01a-4bbd-8640-b3743a3499e6","resolution":{"observed_at":"2026-05-12T12:06:33.775516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Retrieval-augmented generation for knowledge-intensive","venue":null,"work_id":"2b1d9676-7b82-4bbd-80a6-a588b286028a","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5bd7e255de4bb2e64105cf72728e7975d0cda1597cc90beb89f0f24e9ebdaf8e","observation_id":"4a85e997-5c4d-4ab5-9eac-42f34287c9ce","resolution":{"observed_at":"2026-05-12T12:06:33.781725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.100287","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intelligence-Based Medicine , author =","venue":null,"work_id":"47ae337d-aa8b-409a-8be8-92877b8390b5","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:7a6b8fd73c2ff3d012db307e19d4609bac4cc40c984afb1f946c496ac1cbf8eb","observation_id":"fa95bdd7-ead9-4742-80f6-8061dace8f19","resolution":{"observed_at":"2026-05-12T05:11:21.803037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/hospitals3010001","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hospitals , author =","venue":"Hospitals","work_id":"b7122d5c-f827-4d5e-856a-d302a9f2df5f","year":2026},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:330536f531f9802b1c369231094592cafb74a56f4f5af068f28daa6e85b26bee","observation_id":"0a0daf09-b80f-4369-a7fd-e668a9407325","resolution":{"observed_at":"2026-05-12T05:11:21.796355Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.381","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the 62nd","venue":null,"work_id":"9365d454-aa38-459f-8326-dfb784a28f16","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:83d2faed35d046a6d481b3e9e9e50296203f7528aee4e0f1bb3441d50c51b34d","observation_id":"488f1228-f868-4569-a877-7aa79a7f38cc","resolution":{"observed_at":"2026-05-12T05:11:21.782852Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Mordatch, Igor , year =","venue":null,"work_id":"2d9c8206-8b97-4eb4-8202-d9ab21d02d08","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:cc013a2f26678e619d34b7fb5b75b00d63b683564b2cb8a78101ff2e6029b6f9","observation_id":"a122d888-a304-4e87-867d-8314501f0cac","resolution":{"observed_at":"2026-05-12T12:06:33.789182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.13026/1n74-ne17","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alistair Johnson, Tom Pollard, Steven Horng, Leo Anthony Celi, and Roger Mark","venue":"PhysioNet","work_id":"6bd088fa-5aa9-4e90-b989-2aecd1402965","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:17d81b58af0a05031c768c17d9bcfa5bae88e94862403484200e7bc6c657d7a1","observation_id":"905c4b48-4599-4961-9bd9-330ec76dcd29","resolution":{"observed_at":"2026-05-12T05:11:21.778821Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-16T20:21:10.313306+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T20:21:10.313306+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Shamout, Farah E","venue":null,"work_id":"8640ba2b-054b-4e22-8c9c-ba56587b9615","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b68a5dee4b73c2b82cdebfce10251e5dabdd51c5643091f1f2f6982207bc62e8","observation_id":"240c9a5d-a271-4a57-b63d-5f36682677b0","resolution":{"observed_at":"2026-05-12T12:06:33.755061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , pages =","venue":null,"work_id":"f4940ef8-90f3-414f-a7bf-b46f195f2c26","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:07e6c09c594f10dbcae91f14f6e9eaa1cc6f040b6391196469410c5edc173c9e","observation_id":"cd872ba8-7a51-4d5f-8f33-506de68de883","resolution":{"observed_at":"2026-05-12T12:06:33.757832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c8207c36-1689-4661-88a7-62e5971223b6","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b3f065219a5b68959da0879c0d3e0c38ddb03ee2a7dd1a267a1d2fb8e61baf34","observation_id":"f8d8895d-a904-447c-9dec-45b7e839ee71","resolution":{"observed_at":"2026-05-12T12:06:33.772815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":"2306.00890","doi":"10.48550/arxiv.2306.00890","metadata_source":"pith","pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","venue":"cs.CV","work_id":"19dcd63e-57db-4bc7-83cb-d96d41270f55","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b8d22c8171d9cab7e92e786dab7d85aebab8e21e9779c4d2186b1c60c168067c","observation_id":"40a28629-120d-4401-98aa-a88c6afe9627","resolution":{"observed_at":"2026-05-12T05:11:21.960748Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T22:53:39.586163+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T22:53:39.586163+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-06T18:57:51.817317Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":"2406.19280","doi":"10.48550/arxiv.2406.19280","metadata_source":"pith","pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2406.19280 , year=","venue":"cs.CV","work_id":"dd32b8a1-4ad4-4155-b031-c317b565c6e7","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:bd3636e520157f22602009558b23b5165474e026c76478cd758adbad54000fe2","observation_id":"ca4e5bde-3444-4c15-9ffc-148920d52e5d","resolution":{"observed_at":"2026-05-12T05:11:21.929441Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T22:53:37.302988+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T22:53:37.302988+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5caf8db4cb69602e45218c3898fc3455806a9e1c7cd2cd127647f446c10e2707","observation_id":"52437781-bb0c-4cf3-8340-61032040776b","resolution":{"observed_at":"2026-05-12T05:11:21.811686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":"2412.05271","doi":"10.48550/arxiv.2412.05271","metadata_source":"pith","pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":"cs.CV","work_id":"ee70bdc8-4656-4849-ada7-ce42a2278d70","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:f8bb5ffb7791fbc4884c0562886c4d1312c76a5f7830026a8e55abfff8c35fc7","observation_id":"86aaf8f5-e963-4ae2-9d27-b3378cb925d2","resolution":{"observed_at":"2026-05-12T05:11:21.792229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16452","last_updated":"2023-11-28T03:16:12Z","snapshot_observed_at":"2026-08-07T08:26:36.845011Z","submitted_at":"2023-11-28T03:16:12Z","title":"Can Generalist Foundation Models Outcompete Special-Purpose Tuning? Case Study in Medicine","version":1},"cited_work":{"arxiv_id":"2311.16452","doi":"10.48550/arxiv.2311.16452","metadata_source":"pith","pith_arxiv_id":"2311.16452","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Can generalist foundation models outcompete special-purpose tuning? case study in medicine","venue":"cs.CL","work_id":"db7034ec-f9ec-4e2d-a666-0b969db0fd67","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2311.16452","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:385961c0c82276a660bc5d20612d751b0ba965ef4414b7cbd8006e0fe92ae7f3","observation_id":"ec767918-802c-497d-a451-f65b1ab606e5","resolution":{"observed_at":"2026-05-12T05:11:21.948174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T04:33:20.968191Z","title":"Language","venue":null,"work_id":"99d9cebf-3aa9-418a-99d7-852248f88b96","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:e013c90421490f774170e6c2da6d0f3f5d19485a3b2a5ffebbb41a8e164bd6db","observation_id":"56e64423-ac75-48a6-8270-f1c120f20b7b","resolution":{"observed_at":"2026-05-12T12:06:33.762843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":"2303.17651","doi":"10.1007/s10664-008-","metadata_source":"pith","pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","venue":"cs.CL","work_id":"59181e7f-e58e-45d3-8146-4477a9f53d5a","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:34de6d4843e6950660737cfa730e66ea5e52a18ad8ad92e0c5704585277249b9","observation_id":"c77174ce-82b6-4854-867a-1ee4d4761337","resolution":{"observed_at":"2026-05-12T05:11:21.918839Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10454","last_updated":"2026-05-14T20:43:11Z","snapshot_observed_at":"2026-07-06T22:32:27.698678Z","submitted_at":"2025-10-12T05:24:32Z","title":"Traj-CoA: Patient Trajectory Modeling via Chain-of-Agents for Lung Cancer Risk Prediction","version":2},"cited_work":{"arxiv_id":"2510.10454","doi":"10.48550/arxiv.2510.10454","metadata_source":"pith","pith_arxiv_id":"2510.10454","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Traj-coa: Patient trajectory modeling via chain-of-agents for lung cancer risk prediction","venue":"cs.AI","work_id":"3b22d0dd-9310-4741-90b7-df268d5aff53","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2510.10454","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:798523764aa59539dc5af2eedf7a7052a6aee931cb7c4e8d680e69ab573e8727","observation_id":"f195de01-cbd0-49f6-a370-356ad60be745","resolution":{"observed_at":"2026-05-20T00:00:25.943863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 29th","venue":null,"work_id":"c2d42509-f7b9-4742-bb18-993bcd9a4d1a","year":2022},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:7efb254166cb108f8fd041d243f69839100f3482317e8b6659f08578159e0a11","observation_id":"fcf00c6d-9c40-4731-a2a0-1773ae5a915a","resolution":{"observed_at":"2026-05-12T12:06:33.770268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83541d2f-e7c3-461b-9b27-fbdc36627932","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:79a9433771b3508a662fa63b2180bd616f70a50370513e2b3069dd0f65989452","observation_id":"33a81d47-ec96-4a4e-b5b6-882f7cd473b2","resolution":{"observed_at":"2026-05-12T12:06:33.794149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05342","last_updated":"2020-11-29T03:40:45Z","snapshot_observed_at":"2026-07-06T07:45:18.053726Z","submitted_at":"2019-04-10T17:53:13Z","title":"ClinicalBERT: Modeling Clinical Notes and Predicting Hospital Readmission","version":3},"cited_work":{"arxiv_id":"1904.05342","doi":"10.48550/arxiv.1904.05342","metadata_source":"pith","pith_arxiv_id":"1904.05342","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ClinicalBERT: Modeling Clinical Notes and Predicting Hospital Readmission","venue":"cs.CL","work_id":"997be8af-a070-4f1c-8458-8e75c904f12c","year":2019},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/1904.05342","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:d7df9e990f50aef30aecceefaf328bb815851d0d4a1b9ddb48ad3f9ecf629731","observation_id":"7f28da05-2d7c-4cd3-80df-b001161a214a","resolution":{"observed_at":"2026-05-15T09:26:53.041773Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ee902eef-26a7-4940-84e2-64072c5cbb7d","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:84afb7d3cc08ed70a47a45699d20c6d046d35ca19ecb772bf670d9f4a9859ab3","observation_id":"98ff3b63-8d61-4e03-94ad-e0a2a3ef00fc","resolution":{"observed_at":"2026-05-12T12:06:33.796800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2323.2024","doi":"10.1109/bigdata62323.2024.10825018","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Warren, Lu Cheng, Haidar M","venue":null,"work_id":"b2ce1802-acb8-48e0-a0f3-ffcfdeb3e31f","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:29981ed4e96d6394c0b66495d865e37c1b6e453b4cd688501e030eb635ddc7a5","observation_id":"fdef00c9-901d-4245-bd75-1a75f80e2dec","resolution":{"observed_at":"2026-05-12T05:11:21.883326Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8592.2024","doi":"10.1109/iros58592.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dreher, T","venue":null,"work_id":"69074442-dd66-4e16-9324-8a2cc82601db","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b967d8199d8c387260f5ae3c5f4d17731f83547816073d547eaccd012c9145b7","observation_id":"9eb3fa15-e481-4e43-9556-5eed798faa8a","resolution":{"observed_at":"2026-05-12T05:11:21.773962Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T16:19:27.144654+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.08397","doi":"10.48550/arxiv.2410.08397","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guttag, and Adrian V","venue":"arXiv (Cornell University)","work_id":"7e7ba68d-75b3-4c44-a51e-a608f7eae3a4","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:fcf0dd912e76e2d8a0935b0355771b2901868fe7d4a4af23760dec9113d7efd8","observation_id":"4b10719a-0204-4f9a-b429-d8178639a960","resolution":{"observed_at":"2026-05-12T05:11:21.895181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-01550-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhancing diagnostic capability with multi-agents conversational large language models , volume =","venue":"npj Digital Medicine","work_id":"21c4cc19-23bf-412a-a86c-fdb09eeab030","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:928b0368d59d41ab5dd5144d64bd914170ef2a1572025a6f89e8b50708790526","observation_id":"416f1439-4d92-4719-b49c-02220db8ffe6","resolution":{"observed_at":"2026-05-12T05:11:21.821234Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8587.370135","doi":"10.1145/3698587.3701355","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the 15th","venue":null,"work_id":"45aa10dc-c090-4563-8f11-95624897a5eb","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:0187c02f2d6ee221ffffe6efcb0af3e73d3e7157aebf59a43e1f166b97541486","observation_id":"70b9a469-ffcd-4db9-b744-503d77b0c2bb","resolution":{"observed_at":"2026-05-12T05:11:21.868133Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-01940-4","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"npj Digital Medicine , publisher =","venue":"npj Digital Medicine","work_id":"fede7651-bfdc-4f99-81f2-f3fb7452a89d","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:6d575b76a5750cfd83854ee18d70ad9433c274e78442581193fa6fd2495bf9ec","observation_id":"c98274ef-ae7a-47d8-90fa-23d7b9ae7513","resolution":{"observed_at":"2026-05-12T05:11:21.902727Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.510","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mmedagent: Learning to use medical tools with multi-modal agent","venue":null,"work_id":"44f383e1-c7d7-4e30-96e4-20edda002964","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:71caf64fbb2c9e8be9e4e0f878a12afac6478959f9c05c1866e328d5b3c090d1","observation_id":"27c91e59-f0fe-4ec6-a551-cde81b439828","resolution":{"observed_at":"2026-05-12T05:11:21.852360Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:4591f489bf6d3b8bbc8af4f2db8332914e09c93e2a9de53366eb3db77c8399a9","observation_id":"b14b127e-7069-46b9-9cd7-06700aedcde6","resolution":{"observed_at":"2026-05-12T05:11:21.750668Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning","venue":null,"work_id":"d9702084-c9d1-4705-a1d0-cc9d5021a501","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:c05d4f5652c24b36e9cebdc0fe25a2ff166780d08be459c887f88c0b344eaf93","observation_id":"01f38518-7563-454c-b0b5-4941b0016f84","resolution":{"observed_at":"2026-05-12T12:06:33.808654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , journal=","venue":null,"work_id":"5fe2c53f-f8a2-4a74-8ef4-64188786eae5","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:a702c0f41f9440a616458d7ee633cd07ce7ddddaa53bff6a52fd097a703ab159","observation_id":"209f307d-e45b-4695-8214-e9cc2fdf4615","resolution":{"observed_at":"2026-05-12T12:06:33.802570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-07T23:53:34.814339Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":"2507.05201","doi":"10.48550/arxiv.2507.05201","metadata_source":"pith","pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"MedGemma Technical Report","venue":"cs.AI","work_id":"3d3f25c0-31e8-4859-bb3d-0d719b47a63d","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:96940404d0335214e05650c5bcc5e64b78c41f674d4c5091ef9e7bdb2c7f6fce","observation_id":"71ae8a11-63d2-4edb-b22f-63b0737f842a","resolution":{"observed_at":"2026-05-12T05:11:21.714853Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01863","last_updated":"2025-02-24T22:53:22Z","snapshot_observed_at":"2026-08-07T17:51:45.040254Z","submitted_at":"2025-02-24T22:53:22Z","title":"Vision Language Models in Medicine","version":1},"cited_work":{"arxiv_id":"2503.01863","doi":"10.48550/arxiv.2503.01863","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01863","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Vision Language Models in Medicine , February 2025","venue":null,"work_id":"86c27ef3-f665-406a-8f68-2c595f426658","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2503.01863","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:ec8023582dbc957865a5b39540f34d4dc0cc9e9a804febb3498c4520f0954e2d","observation_id":"219aebf7-7581-484f-b603-49a233befad6","resolution":{"observed_at":"2026-05-12T05:11:21.670645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal","venue":null,"work_id":"1e0548a6-96d3-4c40-80a3-e7ef87b691b5","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:1c5b02cc7b3ca9335550ae369518defd2c882ff9659449ef41b04e518c316d8a","observation_id":"bd347140-57e0-412e-bc3c-a2c4120d35ad","resolution":{"observed_at":"2026-05-12T12:06:33.858099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guyon and A","venue":null,"work_id":"e78cc6a8-484b-44db-9b5b-b3e086db38e8","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:fb9dbb0688d7ae11630128a417becf8e126f7bfd76293b64382711eee0baa6b9","observation_id":"9abd689d-4421-495c-9b34-1ffda86b1ecc","resolution":{"observed_at":"2026-05-12T12:06:33.811845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guyon and C","venue":null,"work_id":"2e6a88b8-9bd4-4e79-8102-a11f650bf8f3","year":null},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:ca3ca7ea5a6886afeabd244b8ec6871f8722e2206e7076e4e9a170debca9e44f","observation_id":"1ad8a2c5-ea43-42fa-8a0f-0aa296708d24","resolution":{"observed_at":"2026-05-12T12:06:33.805657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/sdata.2016.35","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MIMIC-III, a freely accessible critical care database","venue":"Scientific Data","work_id":"673c213a-7352-4186-9d68-0046d5e2ec44","year":2016},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5d904d175fbd0c5f6ca306f7123c6544cb4fe0d58f6c9943d0df8ac94755e8fb","observation_id":"505d886b-643f-4855-89c6-9cca37dc03f1","resolution":{"observed_at":"2026-05-12T05:11:21.519615Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T07:08:16.744854+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T07:08:16.744854+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.13026/c2xw26","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MIMIC-III clinical database.PhysioNet, September 2016","venue":"PhysioNet","work_id":"8364cd4c-bff6-4736-add3-d30d88389b55","year":2016},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:24221c205d65cf2a1d9b84d6629caad5db457d911dfa172161b6f486601fd0bd","observation_id":"68de056f-2ebf-4b76-9ed0-ec803bdc543e","resolution":{"observed_at":"2026-05-12T05:11:21.564005Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T15:54:09.278553+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T15:54:09.278553+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/jamia/ocae030","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Clinical risk prediction using language models: benefits and considerations","venue":"Journal of the American Medical Informatics Association","work_id":"147fb03b-501f-4031-8312-1c8b7c00cb14","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:e0f267e14d8e735d0b1f16a01d4e22291f34988a0b03a8c2be1b880d22028f08","observation_id":"ced4230b-1fa7-4f48-bcd7-a6e3bc42aecc","resolution":{"observed_at":"2026-05-12T05:11:21.593576Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1056/aioa2500945","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A pragmatic randomized controlled trial of ambient artificial intelligence to improve health practitioner well-being","venue":"NEJM AI","work_id":"cf86cd79-9755-4b21-a230-007ccc445b7f","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:4179fab0fb9623a223713136992a6d7b9e1946655df720cf8ba62bc147e3bfcb","observation_id":"67e38d2e-4a99-437e-8656-dfd67e9ce55e","resolution":{"observed_at":"2026-05-12T05:11:21.649627Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.173852","doi":"10.3389/fdgth.2026.1738523","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Frontiers in Digital Health","work_id":"f63fc7df-76cf-4524-afff-592369dc7c98","year":2026},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:cc62ce67ba85f401a9e7017baaaaee8eabe15b11748a4a73354f948a1c65511d","observation_id":"6d4620d1-11c9-432e-9a7e-46450ad3879f","resolution":{"observed_at":"2026-05-12T05:11:21.695874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"EHRXQA : A Multi - Modal Question Answering Dataset for Electronic Health Records with Chest X -ray Images","venue":null,"work_id":"5e43066b-b7a2-4e3d-82dc-b49246922682","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:2c883199cc749661a635b85e8753396485bc6baab59b94900cf66083dc096c57","observation_id":"e23ac393-0a15-4091-91bb-094016ca50a3","resolution":{"observed_at":"2026-05-12T12:06:33.818365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:381c6afe8f451e83a880e10111af9091753c439cfe4a81e92002224493999d51","observation_id":"909dd84a-8f62-49c1-b315-c0228c72bd94","resolution":{"observed_at":"2026-05-12T05:31:25.830002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2196/63430","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bicknell, Danner Butler, Sydney Whalen, James Ricks, Cory J","venue":"JMIR Medical Education","work_id":"8af268e6-c91a-4148-8ce5-1a09e911d20d","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:337dec5176f484ac6d71e6eb155807352b616d3ab0f9cb939bac7a880a7dd358","observation_id":"68fac71c-0066-4905-949c-40c69955e1a3","resolution":{"observed_at":"2026-05-12T05:11:21.550928Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":"2005.14165","doi":"10.1145/1926385.1926423","metadata_source":"pith","pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models are Few-Shot Learners","venue":"cs.CL","work_id":"214732c0-2edd-44a0-af9e-28184a2b8279","year":2020},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5c004c1dc39e004ecdd4ea27eef48f0ce2892ba2b1b0d806c0f3130972febbd4","observation_id":"48d31f79-ad17-49fd-8dd3-458f78165c3c","resolution":{"observed_at":"2026-05-12T05:31:25.817942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/20552076231180511","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Knowledge and perception of primary care healthcare professionals on the use of artificial intelligence as a healthcare tool","venue":"Digital Health","work_id":"3645e3e1-e429-4324-8405-f27ca278c2d7","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:9912805bc0dbba6eafe3810cab9ab9e9406a0825e0d5b70f83ae2cff16ba6929","observation_id":"18b31044-ce80-4cf9-9db5-8a359be30395","resolution":{"observed_at":"2026-05-12T05:11:21.568768Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-08-11T04:16:48.156601Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5439717914839f0861f9fa080add12d30a673b37b72921f6b9b8a49ce2ed63ac","observation_id":"d0d71ce1-715c-4037-815f-5e25acfa5a8f","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal Clinical Benchmark for Emergency Care ( MC - BEC ): A Comprehensive Benchmark for Evaluating Foundation Models in Emergency Medicine","venue":null,"work_id":"c4c43f81-4127-416a-8d95-a435380cc262","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5f3a634e673bfc2624286bbb6006230e49e0c6ca3ea51bacd5589967b7d58485","observation_id":"2b5860c5-77d2-4320-a8c8-80f39e1c6c10","resolution":{"observed_at":"2026-05-12T12:06:33.824268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.108121","doi":"10.1016/j.compbiomed.2024.108121","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-modal learning for inpatient length of stay prediction","venue":"Computers in Biology and Medicine","work_id":"d5b8b09b-d102-401f-acaa-c5a2e43cc027","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:473f1518b052b01a256fd010ffe00d8ee37e1b19234e42a5be11cf2a3a2ddb83","observation_id":"60bd4685-df30-430c-950e-d8bd3138c0a9","resolution":{"observed_at":"2026-05-12T05:11:21.577644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-06T18:57:51.817317Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":"2406.19280","doi":"10.48550/arxiv.2406.19280","metadata_source":"pith","pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2406.19280 , year=","venue":"cs.CV","work_id":"dd32b8a1-4ad4-4155-b031-c317b565c6e7","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:9ea228bce2571f27cafba1c813f521c7ee44a661972aacdb8b1e9dd2f52bce57","observation_id":"afc2741f-a9a7-4cdb-a1c9-2a62f8bc5c6a","resolution":{"observed_at":"2026-05-12T05:31:25.823602Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T22:53:37.302988+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T22:53:37.302988+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":"2412.05271","doi":"10.48550/arxiv.2412.05271","metadata_source":"pith","pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":"cs.CV","work_id":"ee70bdc8-4656-4849-ada7-ce42a2278d70","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:94d9f7bb6057f537ce884d16b0c9b0f489a4589b16804ef8f1d54ba43e4b7d6a","observation_id":"d5247dc3-f81b-4fa4-acac-2b9085bb4953","resolution":{"observed_at":"2026-05-12T05:31:25.864501Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tenenbaum, and Igor Mordatch","venue":null,"work_id":"684f264e-da24-45cf-9b6b-339a446adf58","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:70a002c786d78c8c604782f6adc8003a87916b4a15c973c5ee79ac727be03afd","observation_id":"c974c379-564d-4b0c-abe6-e3767e0588b8","resolution":{"observed_at":"2026-05-12T12:06:33.820841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geras, and Farah E","venue":null,"work_id":"ab694dad-8eca-44b4-88e5-49f78d662283","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:6bdefb95ac490be5310e5ea8d6298a0d79ddccb230ee53956c542116721f2a51","observation_id":"d16899d3-b93c-4195-8e63-4aeef8255d9e","resolution":{"observed_at":"2026-05-12T12:06:33.837974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18286","last_updated":"2025-05-23T18:30:24Z","snapshot_observed_at":"2026-08-10T14:47:13.894218Z","submitted_at":"2025-05-23T18:30:24Z","title":"Single-agent or Multi-agent Systems? Why Not Both?","version":1},"cited_work":{"arxiv_id":"2505.18286","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18286","snapshot_observed_at":"2026-07-03T14:58:33.586596Z","title":"Single-agent or Multi -agent Systems ? Why Not Both ?, May 2025","venue":null,"work_id":"118a2970-62fd-46e8-b99c-1cd7842e335c","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2505.18286","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:e7e26853a3fa1de5b7aea2fcf2736f2223507f61e6358202ffd5cac2b26a7515","observation_id":"e536169e-f640-4b34-afcf-23c003c59f29","resolution":{"observed_at":"2026-05-12T05:31:25.871484Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geras, and Farah E","venue":null,"work_id":"38fe1ec8-172c-4a2e-bd07-81e5bf0069ff","year":2022},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:f423c5eaf0e198a1743cb64a6b5e49e86231a31aa178a51396c10b8f6a3d2fbe","observation_id":"d3257e39-8c25-4988-9763-48db517776f3","resolution":{"observed_at":"2026-05-12T12:06:33.860483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":"2308.00352","doi":"10.48550/arxiv.2308.00352","metadata_source":"pith","pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","venue":"cs.AI","work_id":"891b9780-a800-4e3c-bba0-53597ab8dc98","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b7ed8353f8a1f121773921505bb6c16b364ee26fb2d342b589b1ebd2d4356113","observation_id":"880983be-084e-4578-8b73-e43f98306ae7","resolution":{"observed_at":"2026-05-12T05:31:25.809518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MetaPrompting : Learning to Learn Better Prompts","venue":null,"work_id":"f0f71e6c-9603-49d7-8e05-69821dffd195","year":2022},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:cf947664dcee32dbca1ea8561e4f61d6ce06eb1686fb52443e499643d63f8906","observation_id":"17a8b695-b08d-4197-916b-0b217f956bfb","resolution":{"observed_at":"2026-05-12T12:06:33.855144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ClinicalBERT : Modeling Clinical Notes and Predicting Hospital Readmission , April 2019","venue":null,"work_id":"7c6febdd-8577-4fe3-912e-8ce6df2cecc9","year":2019},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:1d6fc8ef2624cf54f417b80080e14fb91ad7a258f8bc7702112f17eea1454b1f","observation_id":"94f839cd-c5f8-4e39-a907-5a4ef5585db7","resolution":{"observed_at":"2026-05-12T12:06:33.849589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41467-025-64430-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"John Wilbur, Zhe He, R","venue":"Nature Communications","work_id":"b37527d6-f3f5-43ae-a519-08830e6c03d8","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:6c71217143466c6cd21fb040fe6dd12dd9c6117640bf0581a6ead2b2f113772a","observation_id":"fc1b640b-e836-4188-8fb8-bb2495924a5d","resolution":{"observed_at":"2026-05-12T05:11:21.644022Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MIMIC - IV - Note : Deidentified free-text clinical notes, 2023 a","venue":null,"work_id":"c9f557eb-ebec-4a2e-87bd-52879f113da4","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:782e87c79a2d8ca75c98584fc462d1066ac78574ac4ad5554d1bc88c4ab9da1b","observation_id":"78e19f98-e0d7-4cdf-8017-0fe91262e548","resolution":{"observed_at":"2026-05-12T12:06:33.852239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41597-019-0322-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URLhttps://www.nature.com/articles/s41597-019-0322-0","venue":"Scientific Data","work_id":"b5ff10f9-da4b-488f-8068-51b18358da75","year":2019},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:6b2a033b60eef84c98a42b4a25e78580bd6a3b36e1401d01f06ab0b269474dd3","observation_id":"7edca90c-5783-400f-9794-93b5a5035b54","resolution":{"observed_at":"2026-05-12T05:11:21.585214Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-01T05:09:01.104742+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T05:09:01.104742+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41597-022-01899-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"cc/paper_files/paper/2019/file/ ac52c626afc10d4075708ac4c778ddfc-Paper","venue":"Scientific Data","work_id":"fb7f21ae-f431-4f2f-baab-48de01ca9beb","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:6de01e71e4d15bacee2950ff6a32571da8d62edfa079024a8a82677037c3c31a","observation_id":"a32491b8-8d1d-4e05-9295-0787a40eaf90","resolution":{"observed_at":"2026-05-12T05:11:21.728236Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T03:18:55.066636+00:00","source":"paper_reference_links","state":"open"},"event_date":"2023-01-16","event_type":"correction","notice_doi":"10.1038/s41597-023-01945-2","provenance":{"observed_at":"2026-07-11T02:59:03.685257+00:00","source":"crossref","source_record_id":"10.1038/s41597-023-01945-2->10.1038/s41597-022-01899-x:correction"}},{"edge_observation":{"observed_at":"2026-07-11T03:18:55.70511+00:00","source":"paper_reference_links","state":"open"},"event_date":"2023-04-18","event_type":"correction","notice_doi":"10.1038/s41597-023-02136-9","provenance":{"observed_at":"2026-07-11T02:59:35.186743+00:00","source":"crossref","source_record_id":"10.1038/s41597-023-02136-9->10.1038/s41597-022-01899-x:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b56994fa-c5f2-498d-a9bc-3471e0cc7a1a","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5f702df3dcb73fd63c68f7d627cf239b8570021b48f886a367aa8d22ca4416aa","observation_id":"e41a7711-bb17-45cd-a70b-fd36762c3e95","resolution":{"observed_at":"2026-05-12T12:06:33.814562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.606","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voting or Consensus ? Decision - Making in Multi - Agent Debate","venue":null,"work_id":"e94c9286-a5b9-4ed4-9eab-6f39d8409b36","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:8301458a830c57b7a9135c9803fd8d4cad9d0964693a23b8ad12adb3abd87e13","observation_id":"8bb30ff7-d8eb-45f4-aa55-0aae2dfc2200","resolution":{"observed_at":"2026-05-12T05:11:21.709628Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01863","last_updated":"2025-02-24T22:53:22Z","snapshot_observed_at":"2026-08-07T17:51:45.040254Z","submitted_at":"2025-02-24T22:53:22Z","title":"Vision Language Models in Medicine","version":1},"cited_work":{"arxiv_id":"2503.01863","doi":"10.48550/arxiv.2503.01863","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01863","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Vision Language Models in Medicine , February 2025","venue":null,"work_id":"86c27ef3-f665-406a-8f68-2c595f426658","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2503.01863","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:7e8b621067c64f66e42cb75be26828474d1438b3582f0feccd559ce9c56ce14c","observation_id":"4c375437-dc30-42cc-8a32-a15a2edceb74","resolution":{"observed_at":"2026-05-12T05:31:25.805519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10916-025-02261-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Clinical Risk Computation by Large Language Models Using Validated Risk Scores","venue":"Journal of Medical Systems","work_id":"06dc4dea-47f3-473e-96b7-e1b272700828","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:86fb944381352feebefd67bf8008d9217fea0a9d571cd20d9461e13129b6b67f","observation_id":"eecf895d-669e-4506-8146-44d8c4b6b708","resolution":{"observed_at":"2026-05-12T05:11:21.660447Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-023-37835-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Medical transformer for multimodal survival prediction in intensive care: integration of imaging and non-imaging data","venue":"Scientific Reports","work_id":"cd72655b-df7a-4646-969c-74b9777617ea","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:8a01b4c144ad675ea7f1ccfaecb2c2fd5fc9eed0ee331c3900a9c6271c26d5ad","observation_id":"623ab034-d58b-450b-8376-039eb80f1745","resolution":{"observed_at":"2026-05-12T05:11:21.664388Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MDAgents : an adaptive collaboration of LLMs for medical decision-making","venue":null,"work_id":"900c0e24-c763-43fd-92f0-4599bd084549","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5c530fff55313e395ef4185c337d630ce91e3adb20427053967955b69e2f0730","observation_id":"1b77f872-e55c-461f-9748-56824b728b98","resolution":{"observed_at":"2026-05-12T12:06:33.863540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.08296","last_updated":"2026-04-08T21:31:49Z","snapshot_observed_at":"2026-08-06T14:12:10.843049Z","submitted_at":"2025-12-09T06:52:21Z","title":"Towards a Science of Scaling Agent Systems","version":3},"cited_work":{"arxiv_id":"2512.08296","doi":"10.48550/arxiv.2512.08296","metadata_source":"pith","pith_arxiv_id":"2512.08296","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Towards a Science of Scaling Agent Systems","venue":"cs.AI","work_id":"df1c366f-f1cf-469a-b862-5d59229b6b8f","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2512.08296","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:5138cf7f1a9d7093e047a3d360235809cb9697b47dfef255eab2280a25808db8","observation_id":"8cd86349-524f-4bde-b1d0-62c2630dd209","resolution":{"observed_at":"2026-05-12T05:31:25.833946Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/bioinformatics/btz682","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bioinformatics , volume =","venue":"Bioinformatics","work_id":"e32e1961-872d-4dc5-84f6-be066ccfc32e","year":2019},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:376495eb1d09d8c3ad64909c43d4b3a7cfc2148d3d8d9798ecc76cabffd50ead","observation_id":"ca0b8734-8b79-49af-8ea6-8bffd0194fde","resolution":{"observed_at":"2026-05-12T05:11:21.604221Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T03:18:56.980866+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T03:18:56.980866+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning Missing Modal Electronic Health Records with Unified Multi -modal Data Embedding and Modality - Aware Attention","venue":null,"work_id":"76dfa849-4ce5-40f6-8e1c-a6d5738c69d3","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:479ca4574278ecc494188f6177242d0cba3533d50c9b5983ecfedb5df03767ca","observation_id":"5b0f7f8c-ea5e-4f72-b302-019b290cd1bb","resolution":{"observed_at":"2026-05-12T12:06:33.866329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s12911-025-03239-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A prompt framework for enhancing LLM -based explainability of medical machine learning models: an intensive care unit application","venue":"BMC Medical Informatics and Decision Making","work_id":"a4467f21-528a-4b9c-9abd-ebeefb93fc33","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:0d0f4ee9fc3561b405164421656033abb04c950ab4ce69b611460946e8813d2e","observation_id":"d81d31eb-3a70-4359-acd7-6a34611eee8f","resolution":{"observed_at":"2026-05-12T05:11:21.634176Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5724.349651","doi":"10.5555/3495724.3496517","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks","venue":null,"work_id":"40575ddf-70f9-45df-9570-65dd46693499","year":2020},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:be8dfe34a25d42c7c438fee893e01fc60f826c472cd5b320325f09df5b4392a1","observation_id":"9c33940e-220e-40d1-9c02-3c07270ed32c","resolution":{"observed_at":"2026-05-12T05:11:21.690309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T17:19:33.90015+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T17:19:33.90015+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":"2306.00890","doi":"10.48550/arxiv.2306.00890","metadata_source":"pith","pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","venue":"cs.CV","work_id":"19dcd63e-57db-4bc7-83cb-d96d41270f55","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:9e27b01f3a56baaa7e116bd43a93f9a5885a470294e3dc5b2a1ab97f28189ffb","observation_id":"5f967fbc-ed65-43e8-b760-3e56eee4a028","resolution":{"observed_at":"2026-05-12T05:31:25.859967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T22:53:39.586163+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T22:53:39.586163+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.992","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Al-Onaizan, Y., Bansal, M., Chen, Y.-N","venue":null,"work_id":"65e0d826-5cd2-4072-9288-bb52d4bef827","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:457145f8a457e32d92d57d2850cad349094d66c949d57a372788acda48546cc1","observation_id":"2a97e58f-bcb2-44cb-a314-fcc5130719e6","resolution":{"observed_at":"2026-05-12T05:11:21.616113Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-22T14:53:01.678668+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T14:53:01.678668+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11737","last_updated":"2025-08-15T17:01:08Z","snapshot_observed_at":"2026-07-06T22:13:37.150049Z","submitted_at":"2025-08-15T17:01:08Z","title":"Ovis2.5 Technical Report","version":1},"cited_work":{"arxiv_id":"2508.11737","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.11737","snapshot_observed_at":"2026-07-02T22:27:25.902699Z","title":"Ovis2.5 Technical Report","venue":"cs.CV","work_id":"83cd504b-a082-4df2-8bff-919343fc7d99","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2508.11737","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:74659a4f78894f3744591c61a3ab777c3438940d4ca683031812cf007cf8a620","observation_id":"6f9506d9-8c65-4988-b182-b5d58158b3fc","resolution":{"observed_at":"2026-05-15T20:30:17.288454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1056/aioa2501000","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lukac, William Turner, Sitaram Vangala, Aaron T","venue":"NEJM AI","work_id":"581bbf89-6b80-4c4d-92b4-a878cb45f197","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:fda15ff722cf57df1a509cecf5017c12b74aa58b29fe4519da4f7549cd7eff5e","observation_id":"3d247753-e3cc-4085-a355-485dbc5deb45","resolution":{"observed_at":"2026-05-12T05:11:21.705146Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":"2303.17651","doi":"10.1007/s10664-008-","metadata_source":"pith","pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","venue":"cs.CL","work_id":"59181e7f-e58e-45d3-8146-4477a9f53d5a","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:dc754715ac2b69741251ad43df9908e9aeda752c8e28fc78c338d0e683e49d51","observation_id":"957eaeca-ed5c-487a-b836-f0ae078f6602","resolution":{"observed_at":"2026-05-12T05:31:25.800945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16452","last_updated":"2023-11-28T03:16:12Z","snapshot_observed_at":"2026-08-07T08:26:36.845011Z","submitted_at":"2023-11-28T03:16:12Z","title":"Can Generalist Foundation Models Outcompete Special-Purpose Tuning? Case Study in Medicine","version":1},"cited_work":{"arxiv_id":"2311.16452","doi":"10.48550/arxiv.2311.16452","metadata_source":"pith","pith_arxiv_id":"2311.16452","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Can generalist foundation models outcompete special-purpose tuning? case study in medicine","venue":"cs.CL","work_id":"db7034ec-f9ec-4e2d-a666-0b969db0fd67","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2311.16452","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:ae2c50da53acc2b75a2365f3da3c41ff7effbc2fbd9a3d3540b63c1ea7ce1cde","observation_id":"ed19ff2b-9d15-4ee3-8e36-240d3f797754","resolution":{"observed_at":"2026-05-12T05:31:25.879478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-07T23:53:34.814339Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":"2507.05201","doi":"10.48550/arxiv.2507.05201","metadata_source":"pith","pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"MedGemma Technical Report","venue":"cs.AI","work_id":"3d3f25c0-31e8-4859-bb3d-0d719b47a63d","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:dc13dbb386c34d7934fd684bcd3981e27d5854c7ac6267901da734d87ff55877","observation_id":"86e46fa3-88c8-4a47-aaa2-b62cb7255e53","resolution":{"observed_at":"2026-05-12T05:31:25.875394Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2147/ijgm.s449598","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transforming Healthcare with AI : Promises , Pitfalls , and Pathways Forward","venue":"International Journal of General Medicine","work_id":"283ce2e4-73e7-4f55-8984-ac19df7ad14c","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:0786bb86521abb19ef45571f5db4613b8cd4fa6b0d3dd4207a40785d60b30369","observation_id":"817be877-f2e7-499a-b59d-a486c346e5d5","resolution":{"observed_at":"2026-05-12T05:11:21.555303Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-023-06291-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:34.713492Z","title":"Large Language Models Encode Clinical Knowledge","venue":"Nature","work_id":"bd063ed4-6265-4e11-8cf5-208f7e1432ac","year":2023},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:b538df62e712d23b43abcbfb2267ea9a3e76af248319731919c949a5f82169ab","observation_id":"5198008f-61c7-48f3-95e0-fc1f6843e3d0","resolution":{"observed_at":"2026-05-12T05:11:21.738778Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T03:19:08.01801+00:00","source":"paper_reference_links","state":"open"},"event_date":"2023-07-27","event_type":"correction","notice_doi":"10.1038/s41586-023-06455-0","provenance":{"observed_at":"2026-07-11T03:08:19.417011+00:00","source":"crossref","source_record_id":"10.1038/s41586-023-06455-0->10.1038/s41586-023-06291-2:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-024-03423-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Singhal, T","venue":"Nature Medicine","work_id":"62ee5922-5bd4-4627-a1e6-5830c9707570","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:2a0bc830eaafe0aaec05706c029e95ba2de6029ffaf615e697854b3710d6fb6c","observation_id":"9631a6e4-7c32-4043-aee4-161770b7c85f","resolution":{"observed_at":"2026-05-12T05:11:21.677554Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-06T21:08:11.595199+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-06T21:08:11.595199+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.6565","doi":"10.1001/jamanetworkopen.2024.6565","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Baxter, Florin Vaida, Amanda Walker, Amy M","venue":"JAMA Network Open","work_id":"9bc52162-e1d8-4188-baa4-d1b50e7a9857","year":2024},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:645e08761311b72ddef5f771eb415c8701cc933c8f3886dd6dab4f06944d0ec8","observation_id":"2baaec85-dd7c-41c4-8242-9cfcad0aae43","resolution":{"observed_at":"2026-05-12T05:11:21.640154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T02:33:07.217362Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":17,"parse_uncertain":1,"unresolved":5,"verified_exact":44,"verified_fuzzy":32},"total_outbound_references":108},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 108 outbound references and 2 inbound Pith citation observations for arXiv:2605.10286."}