{"as_of":"2026-08-14T22:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ed7b681aeb72f8d34f24049156a84e0803e2cfbd74ae49575c3f71646662c73","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:40:16.167357Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:42:34.643403Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24105","snapshot_observed_at":"2026-08-06T16:42:34.643403Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12774","last_updated":"2025-07-17T04:31:55Z","snapshot_observed_at":"2026-08-14T01:04:48.483410Z","submitted_at":"2025-07-17T04:31:55Z","title":"A Comprehensive Survey of Electronic Health Record Modeling: From Deep Learning Approaches to Large Language Models","version":1},"reference_index":170,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:34.643403Z"},"links":{"cited_paper":"/paper/2505.24105","citing_paper":"/paper/2507.12774"},"observation_digest":"sha256:0f03e27e6ab3eaca65976b75d141341850401a0d111b819d6d8f0d556f0daa3c","observation_id":"7e1fa655-5f32-4f99-853b-347455265ae0","resolution":{"observed_at":"2026-08-06T16:42:34.643403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.24105","doi":"10.48550/arxiv.2505.24105","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Rein- forcement Learning","venue":"ArXiv.org","work_id":"c05f77c9-9852-4855-913c-00bd25ede69c","year":2025},"citing_paper":{"arxiv_id":"2512.19691","last_updated":"2026-04-13T08:00:46Z","snapshot_observed_at":"2026-07-31T18:31:36.321575Z","submitted_at":"2025-12-22T18:59:34Z","title":"Scalable Stewardship of an LLM-Assisted Clinical Benchmark with Physician Oversight","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T20:21:40.867354Z"},"links":{"cited_paper":"/paper/2505.24105","citing_paper":"/paper/2512.19691"},"observation_digest":"sha256:cf3024098d6165b5c22e66061f6464c08a3a3cb19f7a081665950e49a86c37c6","observation_id":"415c1475-4b7f-4c82-8317-a9fc9300d54b","resolution":{"observed_at":"2026-05-16T20:23:23.350397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.24105","doi":"10.48550/arxiv.2505.24105","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Rein- forcement Learning","venue":"ArXiv.org","work_id":"c05f77c9-9852-4855-913c-00bd25ede69c","year":2025},"citing_paper":{"arxiv_id":"2603.23964","last_updated":"2026-04-13T08:15:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-25T05:56:54Z","title":"From Pixels to Digital Agents: An Empirical Study on the Taxonomy and Technological Trends of Reinforcement Learning Environments","version":2},"reference_index":183,"source":"pdf_text","source_observed_at":"2026-05-15T01:20:03.181903Z"},"links":{"cited_paper":"/paper/2505.24105","citing_paper":"/paper/2603.23964"},"observation_digest":"sha256:fbb374f793359e9af5dbfdb3fcec223de9b0835ce081a8328f86c0cbd96a0dd5","observation_id":"336f4c34-8c09-48f6-abde-99a5db98e613","resolution":{"observed_at":"2026-05-15T01:23:27.263072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24105/citation-record","integrity":"/paper/2505.24105/integrity","json":"/paper/2505.24105/citation-record.json","paper":"/paper/2505.24105"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:40:05.748193Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:05.748193Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f6b9abdce6d07b82c30e53e210492ad4028a8527b0c27d263ded97fbec357779","observation_id":"88cd335b-b05b-4e69-9ea7-8938a1be17fd","resolution":{"observed_at":"2026-08-07T12:40:05.748193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:05.836155Z","title":"Claude 3 haiku: our fastest model yet, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:05.836155Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f02035e1d637f2a2c5f5ba9218aa485ad4c28a2c4a1918d7098ab857227384e8","observation_id":"d031cc18-80a3-4363-b2aa-beb9f1a67af2","resolution":{"observed_at":"2026-08-07T12:40:05.836155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:24.422437Z","title":"Claude 3.5 sonnet, June 2024","venue":null,"work_id":"cd0ddfcb-3bde-49ca-be3f-df90bcaf0abe","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:05.989525Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:c36512cbfd2d52f29782e368a0a7e6f5510327a26bf6ee72a1d52c57568f280c","observation_id":"ccb64938-c2e3-4146-adf7-1470961a05ba","resolution":{"observed_at":"2026-08-07T12:40:24.573185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:06.100300Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.100300Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:01d558395e1eea456dd954c8cc8b3b53497fd8719e1b2b5262dd15ccd47b739c","observation_id":"25a76a8d-bac8-4dba-8c89-500edc05a857","resolution":{"observed_at":"2026-08-07T12:40:06.100300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:06.195545Z","title":"Rm-r1: Reward modeling as reasoning.arXiv preprint arXiv:2505.02387, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.195545Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:d24fc87f44992d5cbf12e22e32fe67e37c5cea9d52bc638f0c6f8630702303f0","observation_id":"ccf6234e-e6e1-4535-84c1-6581ca90850e","resolution":{"observed_at":"2026-08-07T12:40:06.195545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04176","last_updated":"2025-03-06T07:44:17Z","snapshot_observed_at":"2026-08-10T22:11:10.083264Z","submitted_at":"2025-03-06T07:44:17Z","title":"TIMER: Temporal Instruction Modeling and Evaluation for Longitudinal Clinical Records","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04176","snapshot_observed_at":"2026-08-07T12:40:06.323564Z","title":"Timer: Temporal instruction modeling and evaluation for longitudinal clinical records.arXiv preprint arXiv:2503.04176, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.323564Z"},"links":{"cited_paper":"/paper/2503.04176","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:88b873d512bbeb98e831d1f8bede165747d331b6638f02b741298f71acd87d1c","observation_id":"650e90de-3aa1-40ab-93d0-bd5cfd21236a","resolution":{"observed_at":"2026-08-07T12:40:06.323564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:24.056406Z","title":"A new paradigm for accelerating clinical data science at stanford medicine, 2020","venue":null,"work_id":"b327c7fd-67b6-4ee6-9e7a-7b99cfce30a7","year":2020},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.481447Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:82b1be309ef0b7c066abae7ea3d8e93c6f8e99b0b77ca71daf7958b9da10d8c2","observation_id":"6e6a513b-0f05-4bc0-8d0e-4c93033ec4d1","resolution":{"observed_at":"2026-08-07T12:40:24.207489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:06.646162Z","title":"Electronic health records: then, now, and in the future.Yearbook of medical informatics, 25(S 01):S48–S61, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.646162Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:af24f86eda14b0fe3891f2345c318d6a531b291c2201cacaccff39a133a15ac8","observation_id":"326ae02a-724f-4313-8763-1e01c822d791","resolution":{"observed_at":"2026-08-07T12:40:06.646162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.777990Z","title":"Fleming, Alejandro Lozano, William J","venue":null,"work_id":"eb9af2a6-8b03-4019-9704-e21efc69cb0b","year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.758263Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:9dde9bbfd014e6efb668cbeb32202c0f8c0591ec890f86f635f38e2241f10354","observation_id":"20d7d28e-5b28-48fa-a794-14c19f6efdd7","resolution":{"observed_at":"2026-08-07T12:40:23.908708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.499029Z","title":"Metrics for multi-class classification: An overview.stat, 1050:13, 2020","venue":null,"work_id":"e7dfcabb-fa5c-4c1d-9ac9-1f3b8f28ddf7","year":2020},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.880668Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:ac42e8624db02906490c8dd4802a52d061078b95630b1b245e9e179bd68fa538","observation_id":"c33a26b2-608e-4b8e-b165-9dbfb4c71594","resolution":{"observed_at":"2026-08-07T12:40:23.653417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:40:07.001760Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.001760Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:72e1e3cdc8de4bae84cd7c632667e9872ab0369924ce3c661c03bf941de0c44a","observation_id":"f6f7d809-fa99-4a90-8eff-08d7f966d1db","resolution":{"observed_at":"2026-08-07T12:40:07.001760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:40:07.140634Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.140634Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:7fb2a846ef5052a2d915ad903ec3a2efa9654efc362fce7e43ddaebe39235dfc","observation_id":"8e34339c-d7bc-46cd-a13f-f39629154c2d","resolution":{"observed_at":"2026-08-07T12:40:07.140634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.315844Z","title":"Kale, Greg Ver Steeg, and Aram Galstyan","venue":null,"work_id":"5fe1c2c3-6fe4-4d35-b8ee-5318be5f744e","year":2019},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.316228Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8e2a6ab0fab21fd7c87ae77ae5a7232114613b7337468b38158a48997679b8c1","observation_id":"0c5e5c1d-46c5-4dd2-8e9d-b21bbf86b506","resolution":{"observed_at":"2026-08-07T12:40:23.408150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19898","last_updated":"2025-04-28T15:30:58Z","snapshot_observed_at":"2026-08-07T15:58:33.955467Z","submitted_at":"2025-04-28T15:30:58Z","title":"GenCLS++: Pushing the Boundaries of Generative Classification in LLMs Through Comprehensive SFT and RL Studies Across Diverse Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19898","snapshot_observed_at":"2026-08-07T12:40:07.437399Z","title":"Gencls++: Pushing the boundaries of generative classification in llms through comprehensive sft and rl studies across diverse datasets.arXiv preprint arXiv:2504.19898, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.437399Z"},"links":{"cited_paper":"/paper/2504.19898","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:5f491e0fb678a31a6aecffab8d293ac1fd4b09ea8d1a39ee3e96ee2bd044ba2b","observation_id":"f99164e9-49d7-417a-800b-205e0852b455","resolution":{"observed_at":"2026-08-07T12:40:07.437399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.155428Z","title":"Measuring massive multitask language understanding, 2021","venue":null,"work_id":"4d03edce-2a36-42f6-80f6-0628a6df0be2","year":2021},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.577410Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:81a318c6bcf68eb3c2a3dbe963f7b309c664e3443535103ea0735521138907ca","observation_id":"856cf426-b842-4c7a-9ba6-3811d2568764","resolution":{"observed_at":"2026-08-07T12:40:23.231577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-13T19:45:21.517834Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-07T12:40:07.713578Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning.arXiv preprint arXiv:2503.00223, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.713578Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:bcb2ff9833e811580a9c7f2e2175f41f78da97a4f030aaacbcfc72839c0c93c3","observation_id":"1ad0381e-b8c5-4f9d-a42d-14fa07e5d01c","resolution":{"observed_at":"2026-08-07T12:40:07.713578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04585","last_updated":"2025-04-20T05:49:38Z","snapshot_observed_at":"2026-08-12T22:29:40.742809Z","submitted_at":"2024-10-06T18:46:28Z","title":"Reasoning-Enhanced Healthcare Predictions with Knowledge Graph Community Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04585","snapshot_observed_at":"2026-08-07T12:40:07.860220Z","title":"Reasoning-enhanced healthcare predictions with knowledge graph community retrieval.arXiv preprint arXiv:2410.04585, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.860220Z"},"links":{"cited_paper":"/paper/2410.04585","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:83a58c7afb0580073987a86ccd9fd3c786956a8b906f9aa249c166619da37f99","observation_id":"daf9734b-6cb2-4714-a051-00d83dff8885","resolution":{"observed_at":"2026-08-07T12:40:07.860220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-07T12:40:07.992856Z","title":"Search-r1: Training llms to reason and leverage search engines with reinforcement learning.arXiv preprint arXiv:2503.09516, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.992856Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:124aa2dad51116937a560c84b20dbf423bc842071233e503b7c40a2cc3ff8f9e","observation_id":"25ccaad0-916f-4dae-bbdd-6ece313ae861","resolution":{"observed_at":"2026-08-07T12:40:07.992856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13081","last_updated":"2020-09-28T05:07:51Z","snapshot_observed_at":"2026-08-13T01:26:47.642290Z","submitted_at":"2020-09-28T05:07:51Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13081","snapshot_observed_at":"2026-08-07T12:40:08.110832Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams.arXiv preprint arXiv:2009.13081, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.110832Z"},"links":{"cited_paper":"/paper/2009.13081","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:78908dd77659dcec7b283afbfe1b0f15d57cc1d8c34e2e9c747041d46313f428","observation_id":"7181a258-ea6a-4c20-bbf8-aacec9d18513","resolution":{"observed_at":"2026-08-07T12:40:08.110832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:08.270915Z","title":"Medcalc-bench: Evaluating large language models for medical calculations.Advances in Neural Information Processing Systems, 37:84730–84745, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.270915Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:600aefc96bcf7df553989009b20ec97ba82f0aa45080b78f7e395073ceb4d163","observation_id":"81e95fa0-d63a-404d-b55a-74dc0d2175e0","resolution":{"observed_at":"2026-08-07T12:40:08.270915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02722","last_updated":"2026-07-20T05:28:15Z","snapshot_observed_at":"2026-08-12T18:37:43.807302Z","submitted_at":"2025-05-05T15:23:47Z","title":"Enhancing LLMs' Clinical Reasoning with Real-World Data from a Nationwide Sepsis Registry","version":2},"cited_work":{"arxiv_id":"2505.02722","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.02722","snapshot_observed_at":"2026-08-07T12:40:16.696367Z","title":"Enhancing LLMs' Clinical Reasoning with Real-World Data from a Nationwide Sepsis Registry","venue":"cs.AI","work_id":"9cb1ae78-e027-4186-a3e3-e533daa06849","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.444451Z"},"links":{"cited_paper":"/paper/2505.02722","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f301b97c6286aba3bdef8e82e15da3fc6f7a3bf12482da02a689d61d9d7a6a31","observation_id":"601f646c-4f78-4781-8a0d-ba13c52e6856","resolution":{"observed_at":"2026-08-07T12:40:16.829938Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:08.591865Z","title":"Med-r1: Reinforce- ment learning for generalizable medical reasoning in vision-language models.arXiv preprint arXiv:2503.13939, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.591865Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:6b1611e45bae0d78b6d8a1a82d6e79333208208a2c6b11a180ea44421a2c0cc0","observation_id":"6afc9b05-c40c-40cf-896b-767efb14c6d5","resolution":{"observed_at":"2026-08-07T12:40:08.591865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09421","last_updated":"2025-04-15T07:52:40Z","snapshot_observed_at":"2026-08-07T16:06:13.556152Z","submitted_at":"2025-04-13T04:00:40Z","title":"ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09421","snapshot_observed_at":"2026-08-07T12:40:08.713290Z","title":"Clinicalgpt-r1: Pushing reasoning capability of generalist disease diagnosis with large language model.arXiv preprint arXiv:2504.09421, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.713290Z"},"links":{"cited_paper":"/paper/2504.09421","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:712827c870d5f3717a1834a041a9e6770f1de7c9df0fa9f0c6c7cb7f2a2d46c6","observation_id":"4e93ba54-3132-4bc9-b709-d718fdab05db","resolution":{"observed_at":"2026-08-07T12:40:08.713290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:08.886612Z","title":"Rlaif vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.886612Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f63cdea72fb9313cddb7a8fc734600aac17f3aecee252feb26a71c2deb956e6d","observation_id":"2fa7090f-a704-4064-b023-1af0552eff29","resolution":{"observed_at":"2026-08-07T12:40:08.886612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03066","last_updated":"2024-05-22T16:57:56Z","snapshot_observed_at":"2026-08-13T00:14:26.350564Z","submitted_at":"2024-05-05T22:21:15Z","title":"A scoping review of using Large Language Models (LLMs) to investigate Electronic Health Records (EHRs)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03066","snapshot_observed_at":"2026-08-07T12:40:09.003800Z","title":"A scoping review of using large language models (llms) to investigate electronic health records (ehrs).arXiv preprint arXiv:2405.03066, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.003800Z"},"links":{"cited_paper":"/paper/2405.03066","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:61082c9b5878993d12cabdc975f595095ff513294a1f1b6a25ceed9de96654e3","observation_id":"2975b656-7471-4252-88d4-89164de1da41","resolution":{"observed_at":"2026-08-07T12:40:09.003800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:09.163179Z","title":"Cls-rl: Image classifica- tion with rule-based reinforcement learning.arXiv preprint arXiv:2503.16188, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.163179Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:fe1bbb4378b3bd6f746341170035b7f545a2aafb0e608936c88f493bbf20c744","observation_id":"94c35891-3a53-4a1c-a2bf-6535222ead76","resolution":{"observed_at":"2026-08-07T12:40:09.163179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:09.294209Z","title":"Rec-r1: Bridging generative large language mod- els and user-centric recommendation systems via reinforcement learning.arXiv preprint arXiv:2503.24289, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.294209Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:67a314fd7197b6ee85be40aee477378f10d7b3ac39503d64bbd9f643bf8fc02c","observation_id":"441e5fc8-9d7d-4e00-a28d-9e403f6397ce","resolution":{"observed_at":"2026-08-07T12:40:09.294209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.858733Z","title":"Panacea: A foundation model for clinical trial search, summarization, design, and recruitment.medRxiv, pages 2024–06, 2024","venue":null,"work_id":"df97d655-1ef9-4638-96fd-abc74b037fd4","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.445067Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:485190bb2acfbc3909b822d97d47cc7eb01cb7ee17f4981097abec4acaa5f000","observation_id":"df6f4c4f-8547-405f-9a7c-128c6944d21e","resolution":{"observed_at":"2026-08-07T12:40:23.004693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.622106Z","title":"Pisces: A cross-modal contrastive learning approach to synergistic drug combination prediction","venue":null,"work_id":"950938e3-1bd5-4a54-b771-0fe79441d7cb","year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.593187Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:65656ff905a3ea8fc6792106735e8169f49c8b6e1eec4092a8c04a427c059189","observation_id":"bf925afc-28e4-41b7-8cb3-7827c2d4e9dc","resolution":{"observed_at":"2026-08-07T12:40:22.734561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08967","last_updated":"2024-12-13T04:44:11Z","snapshot_observed_at":"2026-08-13T04:40:53.870336Z","submitted_at":"2024-01-17T04:43:21Z","title":"ReFT: Reasoning with Reinforced Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08967","snapshot_observed_at":"2026-08-07T12:40:09.774303Z","title":"Reft: Reasoning with reinforced fine-tuning.arXiv preprint arXiv:2401.08967, 3, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.774303Z"},"links":{"cited_paper":"/paper/2401.08967","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:d3372dfcaf09a2681aa5ed4b1ccb30d4a121864e75fbfc10eefb04082e4a20a2","observation_id":"77f82f1d-90bb-424d-ad69-2b7662b4c4cf","resolution":{"observed_at":"2026-08-07T12:40:09.774303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06781","last_updated":"2025-02-10T18:57:29Z","snapshot_observed_at":"2026-08-09T17:45:05.773418Z","submitted_at":"2025-02-10T18:57:29Z","title":"Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06781","snapshot_observed_at":"2026-08-07T12:40:09.933663Z","title":"Exploring the limit of outcome reward for learning mathematical reasoning.arXiv preprint arXiv:2502.06781, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.933663Z"},"links":{"cited_paper":"/paper/2502.06781","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8f6facb46b714e20a8f805df45f4021f58aad7aad53d23ff924e6ad3f1015f30","observation_id":"747e0839-1ec3-49c4-b4f8-1e95d895c7b6","resolution":{"observed_at":"2026-08-07T12:40:09.933663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-13T20:16:31.803514Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T12:40:10.057892Z","title":"Mm-eureka: Exploring the frontiers of multimodal reasoning with rule-based reinforcement learning.arXiv preprint arXiv:2503.07365, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.057892Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:a9e2a323c7c0f9a9450e12e39e4b0f281c99cb0de4f8da647c085766193697a0","observation_id":"05492bca-953b-45f2-ba62-608ce5783f72","resolution":{"observed_at":"2026-08-07T12:40:10.057892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.450037Z","title":"Can generalist foundation models outcompete special-purpose tuning? case study in medicine.Medicine, 84(88.3):77–3, 2023","venue":null,"work_id":"77aeeece-2dda-4317-a5ed-879c0d899c62","year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.157196Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e5f5f3d4e52bbc6164aa6136a5f90b4f776bc63c6b7123d9f819a138cfcb5085","observation_id":"15441b47-519d-44f8-b74b-2f1a43c0cf99","resolution":{"observed_at":"2026-08-07T12:40:22.511312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.319652Z","title":"Openai o3-mini","venue":null,"work_id":"ab6a020e-5af1-467f-92de-73f8f9ae087b","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.270598Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:b0247225d9b03b002485f2cbccb1ce3906bda9eae4b4c8787dd676d9ede47570","observation_id":"d30ad90a-484b-4757-8c9b-68502463b61d","resolution":{"observed_at":"2026-08-07T12:40:22.359460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:10.395468Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.395468Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:3de3805fc4dd89bbc8bd08dabd5864ec563751db75dc597dc1be2400452da4eb","observation_id":"4cb3e704-503c-471f-aa35-5a853328c76e","resolution":{"observed_at":"2026-08-07T12:40:10.395468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:10.512776Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.512776Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8952002c68e56763e994b978638dd52de75132a20d8a00a62e6e2f6562946b18","observation_id":"f1baf4f4-88fa-417e-9e9b-0245d92c04ff","resolution":{"observed_at":"2026-08-07T12:40:10.512776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:10.620491Z","title":"Medmcqa: A large-scale multi-subject multi-choice dataset for medical domain question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.620491Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:915717685dc874b6895c8cc9615a1e6c7defa5234873eac5fd4300d00ea61f63","observation_id":"e539073f-d59f-4e20-8372-62e44b4d1d5b","resolution":{"observed_at":"2026-08-07T12:40:10.620491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-07T12:40:10.729078Z","title":"Medvlm-r1: Incentivizing medical reasoning capability of vision-language models (vlms) via reinforcement learning.arXiv preprint arXiv:2502.19634, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.729078Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:5a7fd55dec6b213ade912388e89cad28d599e19f4623f71bdd0eab39df8147d2","observation_id":"ea8fe538-4e8d-4330-8df7-7642bab30f10","resolution":{"observed_at":"2026-08-07T12:40:10.729078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T12:40:10.817997Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl.arXiv preprint arXiv:2503.07536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.817997Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:a5b6f033a88be5fad673020455cb570518dc6a4a19b72e89ca3494804e2db2d1","observation_id":"a5658105-bbc9-4f79-9842-5336daec8d31","resolution":{"observed_at":"2026-08-07T12:40:10.817997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13950","last_updated":"2025-04-16T09:16:12Z","snapshot_observed_at":"2026-08-14T19:30:22.807036Z","submitted_at":"2025-04-16T09:16:12Z","title":"Open-Medical-R1: How to Choose Data for RLVR Training at Medicine Domain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13950","snapshot_observed_at":"2026-08-07T12:40:10.939828Z","title":"Open-medical-r1: How to choose data for rlvr training at medicine domain.arXiv preprint arXiv:2504.13950, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.939828Z"},"links":{"cited_paper":"/paper/2504.13950","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:fb42aa0d27b5e7b2065f823cb15f987545dac8dc9b04c67acc6aa5e71617dacd","observation_id":"a6d1740c-1ff0-4826-a24e-ffe0f51b25dc","resolution":{"observed_at":"2026-08-07T12:40:10.939828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:11.066282Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.066282Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:1fc0e0603801b39222880bee866348ae2bb45725af6a026e32079c492cdd048d","observation_id":"89a6aaa2-52c3-446e-bdf2-aba93ce4177a","resolution":{"observed_at":"2026-08-07T12:40:11.066282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.208127Z","title":"Overview of the trec 2021 clinical trials track","venue":null,"work_id":"af813e62-a9b8-4aef-85ca-3885ba275581","year":2021},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.129702Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:3555d473ca4f607b54bbe33cd6fca4bb804e19abd3f06445be4561f952cfbea6","observation_id":"41a07926-025e-42f1-ac89-d8f46f86f932","resolution":{"observed_at":"2026-08-07T12:40:22.244817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:40:11.264725Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.264725Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e63cfe9171f21dde3c1798d7c82c0bf16d677d4730a93cc92bb036aa7638b0bf","observation_id":"ef5a72be-b684-48ee-bdcb-77fea2b15e24","resolution":{"observed_at":"2026-08-07T12:40:11.264725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:40:11.414091Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.414091Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:9c08966432e841c11021edad229d8f4f1b645935cedda6e02ea9ff8d6f41831a","observation_id":"696f8fb7-b375-40b8-9f4d-88b6a322a84b","resolution":{"observed_at":"2026-08-07T12:40:11.414091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T12:40:11.531409Z","title":"Hybridflow: A flexible and efficient rlhf framework.arXiv preprint arXiv: 2409.19256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.531409Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:fd766b8189227168afce138312037d9863624a6a8768ff1d285df2152cfc27b2","observation_id":"cdcc5a0b-5908-41c5-bf23-98b54e24d8f8","resolution":{"observed_at":"2026-08-07T12:40:11.531409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:11.665979Z","title":"Large language models encode clinical knowledge.Nature, 620(7972):172–180, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.665979Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:3d69df223e85dd31bf3e19b2ff8570b0b80d4a77bb75adaa0229c84b321f4679","observation_id":"54a5c2ea-eec3-4fa9-9a1d-cce29d0c827d","resolution":{"observed_at":"2026-08-07T12:40:11.665979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.063540Z","title":"Toward expert-level medical question answering with large language models.Nature Medicine, pages 1–8, 2025","venue":null,"work_id":"cbbd7dcc-829a-42c6-b340-d4d223d9f853","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.804203Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:37a982540c8c5b9d10c817975f824c1c8a3ec5ca14df64592bee75586a57559a","observation_id":"7a7dded0-d419-47c2-9967-0ad3bdb0274f","resolution":{"observed_at":"2026-08-07T12:40:22.139607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-08-09T05:07:17.305244Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-07T12:40:11.914141Z","title":"R1-searcher: Incentivizing the search capability in llms via reinforcement learning.arXiv preprint arXiv:2503.05592, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.914141Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:b894f69f7d1ad4df029b32e886e7d462010560602c4d7bd9eaad8f666d823571","observation_id":"8e4dc3a9-b1cb-43b2-bfe1-a9e3461b421e","resolution":{"observed_at":"2026-08-07T12:40:11.914141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01886","last_updated":"2025-04-02T16:43:16Z","snapshot_observed_at":"2026-08-11T23:21:05.629271Z","submitted_at":"2025-04-02T16:43:16Z","title":"GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01886","snapshot_observed_at":"2026-08-07T12:40:12.027646Z","title":"Gmai-vl-r1: Harnessing reinforcement learning for multimodal medical reasoning.arXiv preprint arXiv:2504.01886, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.027646Z"},"links":{"cited_paper":"/paper/2504.01886","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:cd900660cddbfe4ed8ac1561360d46ec76321e84266fb50f05eb147b19d176fa","observation_id":"cd557f50-9eff-4477-9534-8923451c3e2e","resolution":{"observed_at":"2026-08-07T12:40:12.027646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23829","last_updated":"2025-04-01T14:48:02Z","snapshot_observed_at":"2026-08-10T14:48:37.196526Z","submitted_at":"2025-03-31T08:22:49Z","title":"Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23829","snapshot_observed_at":"2026-08-07T12:40:12.121976Z","title":"Expanding rl with verifiable rewards across diverse domains.arXiv preprint arXiv:2503.23829, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.121976Z"},"links":{"cited_paper":"/paper/2503.23829","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:d3f5a317d051178101dfebe1ab9cdb58b1fe6e6cd40b27c441b7650609bceb90","observation_id":"645593a1-35a9-47e3-9965-95a705d71bbf","resolution":{"observed_at":"2026-08-07T12:40:12.121976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-11T01:31:26.242281Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T12:40:12.244157Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.244157Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:5761ccc11948737bbf1e8bb180b27f5ffd52ce18c641787b0ad1a0911ac22db9","observation_id":"72ca7834-9d41-4ad0-9926-1b3fb3afe746","resolution":{"observed_at":"2026-08-07T12:40:12.244157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.767608Z","title":"Yet another ICU benchmark: A flexible multi-center framework for clinical ML","venue":null,"work_id":"9c1b288f-5bee-4227-a9fb-3fe16253ae3a","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.354142Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:49d332b7e3861e65e263d4a07ee08c9ad3a8b53b53b37b5e885d9a19dfdd7c73","observation_id":"13ca0bb1-7e27-4cd9-a282-2bb9402481cf","resolution":{"observed_at":"2026-08-07T12:40:21.914155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.549793Z","title":"Drg-llama: tuning llama model to predict diagnosis-related group for hospitalized patients.npj Digital Medicine, 7(1):16, 2024","venue":null,"work_id":"17ce7f6a-f223-4841-be0e-a7abe6edc24b","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.471664Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e5daa6db5091dd0f3461d320e03d21e62f0450f61236ac5d3d7cd44a7cf62388","observation_id":"c12f8d70-63dd-4ca7-adbe-2b50f4f32d0b","resolution":{"observed_at":"2026-08-07T12:40:21.641415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-07T12:40:12.554505Z","title":"Reinforcement learning for reasoning in large language models with one training example.arXiv preprint arXiv:2504.20571, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.554505Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:282d67a4a0c6eef33955a4d3dc244e46b482ccf86e6ae754ec8b892b22bc6633","observation_id":"9a51b7fa-1c5c-49d7-92f2-0c1a3ea56ff4","resolution":{"observed_at":"2026-08-07T12:40:12.554505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:12.648627Z","title":"Ehrshot: An ehr benchmark for few-shot evaluation of foundation models.Advances in Neural Information Processing Systems, 36:67125–67137, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.648627Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f6e9190aff1d8fedc572a26677601c9c5ef98b2ff8c6a56dbe9cee3b584799ba","observation_id":"c1ddffc4-6a31-42d1-9fad-801d8cd29507","resolution":{"observed_at":"2026-08-07T12:40:12.648627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12961","last_updated":"2023-03-24T21:50:03Z","snapshot_observed_at":"2026-08-13T12:18:49.838767Z","submitted_at":"2023-03-22T23:54:14Z","title":"The Shaky Foundations of Clinical Foundation Models: A Survey of Large Language Models and Foundation Models for EMRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12961","snapshot_observed_at":"2026-08-07T12:40:12.766149Z","title":"The shaky foundations of clinical foundation models: A survey of large language models and foundation models for emrs.arXiv preprint arXiv:2303.12961, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.766149Z"},"links":{"cited_paper":"/paper/2303.12961","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:22d396968498e7b547e748f0ca3b5cf221febbd6a122358d9ef4eaf432aa18b4","observation_id":"a76b5e70-0439-4c0a-aa4e-d73a821e1bfa","resolution":{"observed_at":"2026-08-07T12:40:12.766149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09258","last_updated":"2025-04-18T07:21:19Z","snapshot_observed_at":"2026-08-07T16:06:17.294598Z","submitted_at":"2025-04-12T15:32:16Z","title":"PathVLM-R1: A Reinforcement Learning-Driven Reasoning Model for Pathology Visual-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09258","snapshot_observed_at":"2026-08-07T12:40:12.932030Z","title":"Pathvlm-r1: A reinforcement learning-driven reasoning model for pathology visual-language tasks.arXiv preprint arXiv:2504.09258, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.932030Z"},"links":{"cited_paper":"/paper/2504.09258","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:d2250c5ab174e5d09bd730d6a1973e08a9d12b3c09d2883d7f26389e97d2a1ed","observation_id":"15631cde-5f52-4257-aac4-7dd590444ca3","resolution":{"observed_at":"2026-08-07T12:40:12.932030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02686","last_updated":"2025-06-12T16:39:09Z","snapshot_observed_at":"2026-08-14T13:25:46.125659Z","submitted_at":"2025-05-05T14:33:49Z","title":"Sailing by the Stars: A Survey on Reward Models and Learning Strategies for Learning from Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02686","snapshot_observed_at":"2026-08-07T12:40:13.070016Z","title":"Sailing ai by the stars: A survey of learning from rewards in post-training and test-time scaling of large language models.arXiv preprint arXiv:2505.02686, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.070016Z"},"links":{"cited_paper":"/paper/2505.02686","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e4cdef2ba83f7f3b36e49f532bb570ec5473df8a95bd75e1ba0d3450ed967ebb","observation_id":"b08205ac-ba61-43a9-a7d5-dbcb2efed3b2","resolution":{"observed_at":"2026-08-07T12:40:13.070016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.380157Z","title":"Instruction tuning large language models to understand electronic health records","venue":null,"work_id":"049a92de-a6c7-40c7-bf5c-e97877571caf","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.220372Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:6653e912934b6dd97692c6bf13686c998cc002ca9524abd0a15ecaa67709354c","observation_id":"e5edff52-49fb-4c3a-87aa-6758030fa9da","resolution":{"observed_at":"2026-08-07T12:40:21.445973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-07T12:40:13.347732Z","title":"Logic-rl: Unleashing llm reasoning with rule-based reinforcement learning.arXiv preprint arXiv:2502.14768, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.347732Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8c3b038432b54cea3ab8fe98b2f05b39684c790285495628c625c2b44827e64e","observation_id":"0f342469-489a-4218-8dc4-7051792f570d","resolution":{"observed_at":"2026-08-07T12:40:13.347732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.204244Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":"4f6cab8e-ac6d-4754-9c10-ccf5610d1de8","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.455171Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:5209ef6432ed70c7259ffdf26d9f9a11a4c8190a346fcc584d72c3964234739b","observation_id":"84b1490f-7a21-4bb0-a6b9-faf8d27154c5","resolution":{"observed_at":"2026-08-07T12:40:21.277106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T12:40:13.610491Z","title":"Dapo: An open-source llm reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.610491Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:62dc758f8581f97a7051b17c77c68004cd225e646943200b21ca08b11525778b","observation_id":"9c2a96cf-38b2-41b9-9ea6-59fc39a26ca3","resolution":{"observed_at":"2026-08-07T12:40:13.610491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19655","last_updated":"2025-02-27T00:54:38Z","snapshot_observed_at":"2026-08-13T21:48:55.289892Z","submitted_at":"2025-02-27T00:54:38Z","title":"Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19655","snapshot_observed_at":"2026-08-07T12:40:13.760606Z","title":"Med-rlvr: Emerging medical reasoning from a 3b base model via reinforcement learning.arXiv preprint arXiv:2502.19655, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.760606Z"},"links":{"cited_paper":"/paper/2502.19655","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:93e084b9c599e2ef707813ce44cbdf13c84ea1d04a15b649043643b7d3e740ff","observation_id":"c42987b4-5995-4040-8344-5dd7c2152bac","resolution":{"observed_at":"2026-08-07T12:40:13.760606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06034","last_updated":"2025-03-08T03:14:26Z","snapshot_observed_at":"2026-08-13T00:19:30.386474Z","submitted_at":"2025-03-08T03:14:26Z","title":"Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06034","snapshot_observed_at":"2026-08-07T12:40:13.873620Z","title":"Rank- r1: Enhancing reasoning in llm-based document rerankers via reinforcement learning.arXiv preprint arXiv:2503.06034, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.873620Z"},"links":{"cited_paper":"/paper/2503.06034","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:35c3b6f87dce9ea9ed587d8d106383bc50c25f29da7d6950c4ff7025f72425d8","observation_id":"2f092779-c71c-4252-97c3-7069f5184840","resolution":{"observed_at":"2026-08-07T12:40:13.873620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.070733Z","title":"Details are provided in Section F","venue":null,"work_id":"fda59595-e8bf-48ad-a06e-70dfcea3a188","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.010225Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:d29a81c37372000c4ceb1ff9713d93615d04ed3fa9722cbc6a26322e4e4ea6c1","observation_id":"2c36a95e-4922-4f60-ac37-678ff6b83b2e","resolution":{"observed_at":"2026-08-07T12:40:21.135687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.904693Z","title":null,"venue":null,"work_id":"7d72183e-2d32-4693-80f2-8604c80e7491","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.133635Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:820edbfbc92330005cbb72f306cbfc1f309a07b998f49bd79707523ed8463731","observation_id":"b3e4d5c4-aeb4-4a14-ae2a-36027c04532f","resolution":{"observed_at":"2026-08-07T12:40:21.008685Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.671608Z","title":"See Section F.3.4","venue":null,"work_id":"e3b22f3b-592d-473d-9c37-95781c2f7839","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.231461Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:876b6bd504707a3cbaf98a98f1e6aa6313d2ee24f986de7a2553cfa83b8e1665","observation_id":"89263a09-dd93-48a7-9451-70723d27474b","resolution":{"observed_at":"2026-08-07T12:40:20.770263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.480008Z","title":"Given a dose of Drug A, what is the equivalent dose of Drug B?","venue":null,"work_id":"0cbaf3c8-3aa1-4da5-bd60-b83c299aa9e6","year":2021},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.373677Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:5546cbb64a04ac2d34ecedca54bcb751fbc25ce95ec15edb00ffd74c05933f73","observation_id":"7f6da25b-063a-4bec-bcc1-748d665d2a26","resolution":{"observed_at":"2026-08-07T12:40:20.562596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.236664Z","title":null,"venue":null,"work_id":"f9ef69b0-af2e-423d-9ab8-ceb83e2656f0","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.559299Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:2b9221a90e3a275ade5977d7e4b5889fe3a6c531432d0e90a2c0b6cba2fbfadb","observation_id":"3f082de1-aab8-42ea-9684-4b33f0fe3537","resolution":{"observed_at":"2026-08-07T12:40:20.376274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.931009Z","title":null,"venue":null,"work_id":"9a0f816b-0181-4cb7-9fbd-955131fbe0a4","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.725894Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:5c6e271e550fe8f565f73bbefd43f5bfe727437fa52b8cc0512f2bdc041571ce","observation_id":"4180e1d6-005e-4cd2-8e52-377b263abc24","resolution":{"observed_at":"2026-08-07T12:40:20.075209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.719980Z","title":"Key Considerations: - Carefully **evaluate each inclusion and exclusion criterion individually**","venue":null,"work_id":"acba23a4-93e7-4ee1-b824-6966eb3f91dd","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.845286Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:15188c1df0f2ad969fa6b129d1a2a458b77f0d465573e0078ab2e6c032c15353","observation_id":"1538b0e0-2b9b-47d7-9e2e-13491bcfa142","resolution":{"observed_at":"2026-08-07T12:40:19.826437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.467167Z","title":null,"venue":null,"work_id":"9d3aa069-0dd0-499d-a5bd-9b9a5a803cd4","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.988132Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e966c02dc674308149f1c599a41e97973d137f4570e808c250e120f65b9d7358","observation_id":"78876dcd-e8c1-425c-9b11-9bb14550e8ad","resolution":{"observed_at":"2026-08-07T12:40:19.596276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.938884Z","title":"The reasoning should be comprehensive, medically sound, and clearly explain how the patient’s information leads to the predicted outcome","venue":null,"work_id":"fc169a50-40e1-4293-adab-0b275ae61bd8","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.327917Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:ca7064ce7a51c9b7bd822e16134b407c657b28622815600677e8f7003ea6eddb","observation_id":"1f7bfa90-eef2-488c-b6be-8211fe1cac03","resolution":{"observed_at":"2026-08-07T12:40:19.047445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.667730Z","title":null,"venue":null,"work_id":"2501e712-95be-4a5e-8bf3-df669c7312a1","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.442336Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:88a26c7b8ea5c890c37fcc565835c3f477e43bc54b406e406243cc854aa2e949","observation_id":"387b5318-5e61-4ea8-83b0-442d1ce234c6","resolution":{"observed_at":"2026-08-07T12:40:18.784235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.172319Z","title":"Very Confident","venue":null,"work_id":"1845a6f9-41eb-479b-b4b6-261d184bfbf2","year":2020},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.652511Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:2b3fd7f66592baf54810a1f65cd60a687565757984f79fb7aaca609adb976215","observation_id":"5e44305c-dc9b-472a-a6dd-159556210ead","resolution":{"observed_at":"2026-08-07T12:40:18.288998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.909632Z","title":null,"venue":null,"work_id":"eaff7c3d-d637-45d6-9054-a94f911cc367","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.731643Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:7fd6aa14e533fbe16f87fefd6090a36a03cb89c087566f9afeef7551cb7d9019","observation_id":"92b791e6-2377-437c-a8b9-e4c34729e477","resolution":{"observed_at":"2026-08-07T12:40:18.047633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.185773Z","title":null,"venue":null,"work_id":"2dd7cea5-f548-4f30-a47b-6b719df02307","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.782070Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:89fd3de73d484abcc05f755274abd43009ba5f76b3d8bfdcfe060a83b8cd122b","observation_id":"7b2ca135-5919-404b-be3d-7db4b0520553","resolution":{"observed_at":"2026-08-07T12:40:19.322411Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.670039Z","title":"The reasoning should be comprehensive, medically sound, and clearly explain how the patient’s information leads to the predicted outcome","venue":null,"work_id":"522b5c1c-2946-466a-9f6f-08ae642f735d","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.870417Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:3d1c1909ca844a12550728785b285d1f725c24d4f15a3fdcc956aa2fc26793cb","observation_id":"194b7b38-6e3b-4078-b552-77fe310ea1e4","resolution":{"observed_at":"2026-08-07T12:40:17.796523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.386300Z","title":null,"venue":null,"work_id":"09c49eb0-aad1-4982-99e1-4ba3f804eae3","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.940088Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:0e4346e75c40bb9f3259cbf07e97bab6e90b497d9ab49371fe5bc7f38970fb50","observation_id":"6e146c0a-7796-4a19-8648-cd5cd0d43b6b","resolution":{"observed_at":"2026-08-07T12:40:17.503210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.414065Z","title":null,"venue":null,"work_id":"6b1d3dc7-ea27-430c-9c25-a9a42735e5f3","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:16.057297Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:25a1e82092fde6337a0403c7fade258c2d6fc9ef10e8403cdd44757558cfc79a","observation_id":"0b633e40-d006-4f11-9604-1435024ec891","resolution":{"observed_at":"2026-08-07T12:40:18.546105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.119372Z","title":"Very Confident","venue":null,"work_id":"33eeb4c1-26d7-4349-ba05-c58feb3c37b9","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:16.167357Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:30b4431dc40782703d8cf131fdf8d502ae3045324f25cf98eaa633afa6985b75","observation_id":"72c93ba4-f781-4338-a665-c3c17665769b","resolution":{"observed_at":"2026-08-07T12:40:17.248724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T13:46:57.143129Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 3 inbound Pith citation observations for arXiv:2505.24105."}