{"as_of":"2026-08-09T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a819d50fd226067651761fc42ab9bf274b1b445b5316670641182925fcc83ac8","coverage":[{"denominator":281,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:08:54.087214Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:22:25.648004Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:00:58.380446Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"cited_work":{"arxiv_id":"2508.21101","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21101","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xiaoye Qu, Yafu Li, Zhaochen Su, Weigao Sun, Jianhao Yan, Dongrui Liu, Ganqu Cui, Daizong Liu, Shuxian Liang, Junxian He, and 1 others","venue":null,"work_id":"77960c16-7b2d-4d6a-860d-eadc61d234f7","year":2025},"citing_paper":{"arxiv_id":"2604.10918","last_updated":"2026-04-13T02:34:30Z","snapshot_observed_at":"2026-07-06T22:59:27.499664Z","submitted_at":"2026-04-13T02:34:30Z","title":"CSPO: Alleviating Reward Ambiguity for Structured Table-to-LaTeX Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:22:25.648004Z"},"links":{"cited_paper":"/paper/2508.21101","citing_paper":"/paper/2604.10918"},"observation_digest":"sha256:2d585323945cab13fd034e30e139ea5372fb0572abe0dc006c8d352c51bac96c","observation_id":"e64ed3d2-4775-4f5e-b875-b75b61a14243","resolution":{"observed_at":"2026-05-11T09:00:58.382781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.21101/citation-record","integrity":"/paper/2508.21101/integrity","json":"/paper/2508.21101/citation-record.json","paper":"/paper/2508.21101"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:45.530518Z","title":"Apprenticeshiplearningviainverserein- forcement learning, in: Proceedings of the twenty-first international conference on Machine learning, p","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.530518Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:cb3ef5ab99ced486109651a0cf6177be707fe0898b084a7eab2fa3e72205f837","observation_id":"e20443c0-a6f6-448b-8e71-f493803dd5ba","resolution":{"observed_at":"2026-08-05T15:08:45.530518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.16393","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.747437Z","title":"A prehospital triage system to detect traumatic intracranial hemorrhage using machine learning algorithms","venue":null,"work_id":"d6490a88-bf78-4e54-9919-076e0ad4ef38","year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.636977Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:608a707dbbcc7d6aec2b7364d77e61143b5a74fec5ccf7239061262c00836bf8","observation_id":"7ea9e247-3d4d-4891-a5b8-a995c06a0590","resolution":{"observed_at":"2026-08-05T15:08:56.753280Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:45.769343Z","title":"Machine learning in clinical decision making","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.769343Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f9171b0208803bb7de27f1d1ef428cbf5514face54688eadff7949c8cd2ed1c4","observation_id":"a8365f3d-cf53-4644-8ccc-8cacfa86120f","resolution":{"observed_at":"2026-08-05T15:08:45.769343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:45.935638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.935638Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:901fd2fbe7c91277c69e4cd82ad3d788b758cc0f2fa1d93b083e3ebe8e684da1","observation_id":"8fa8520c-8ed6-4681-a6c3-7f84c03be345","resolution":{"observed_at":"2026-08-05T15:08:45.935638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.043391Z","title":"Optimized blockchain-basedhealthcareframeworkempoweredbymixedmulti- agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.043391Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:050e252ce5b399693c3f2b71f31cf05ca9aac09647f797d37e4e58383ef7177d","observation_id":"8dfb0261-d3e2-4757-8f8d-e4e4eacfc651","resolution":{"observed_at":"2026-08-05T15:08:46.043391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.207662Z","title":"A systematic review of trustworthy and explain- able artificial intelligence in healthcare: Assessment of qual- ity, bias risk, and data fusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.207662Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:940f9abddaa24c1f29d6cf8fa81e35cca03926a7ae9c074694a101cbd0446ec7","observation_id":"7aaa4125-4d1e-4371-8aca-b3c2bdaf507d","resolution":{"observed_at":"2026-08-05T15:08:46.207662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.08217","last_updated":"2018-07-22T01:07:43Z","snapshot_observed_at":"2026-07-06T06:51:35.633345Z","submitted_at":"2018-07-22T01:07:43Z","title":"Asynchronous Advantage Actor-Critic Agent for Starcraft II","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.08217","snapshot_observed_at":"2026-08-05T15:08:46.539904Z","title":"Asynchronousadvantageactor-criticagentfor starcraft ii","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.539904Z"},"links":{"cited_paper":"/paper/1807.08217","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a5f8cca5934f39aa1e772a92515d5db5c49ff237c95700ec19955383018799d3","observation_id":"9e4751f1-560d-4a10-a843-aa4a3e926282","resolution":{"observed_at":"2026-08-05T15:08:46.539904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.706161Z","title":"Reinforcement learning in healthcare: optimizing treatmentstrategies,dynamicresourceallocation,andadaptiveclin- ical decision-making","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.706161Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a726e41ef438cf66c2bfc05d52cbabb54835a3259c914aea9a85a14388c7a0d6","observation_id":"133d13ac-a0f0-4e9f-8906-6e7e20fd7048","resolution":{"observed_at":"2026-08-05T15:08:46.706161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.829657Z","title":"Explainabilityforartificialintelligenceinhealthcare: a multidisciplinary perspective","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.829657Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f20f1c23dd860bc3bd32021d2888ec0f45b7121980613b3b7930f02ccce19496","observation_id":"a4169ad2-3cae-4363-a969-776202c75269","resolution":{"observed_at":"2026-08-05T15:08:46.829657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.925741Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.925741Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:5ca2e17c22466ec734ccdda0eef14b526db527aaf540886294f89b6eca521e2c","observation_id":"c610baf5-ce9f-40c9-9e7a-188383100ecb","resolution":{"observed_at":"2026-08-05T15:08:46.925741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.036255Z","title":"A comprehensive review on machine learning in healthcare industry: classification, restrictions, opportunities and challenges","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.036255Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a316d4448eeb44b75de8f065b24ab2513563254df629141a0e07bfe365fd30ee","observation_id":"4b88890c-bb42-4578-8eb1-aa60ecc1c6d0","resolution":{"observed_at":"2026-08-05T15:08:47.036255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.153146Z","title":"On the challenges of using reinforcement learning in precision drug dosing:Delayandprolongednessofactioneffects,in:Proceedingsof the AAAI Conference on Artificial Intelligence, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.153146Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9632992aa3be77682f5b526452c33501b05d0cd450f0b75245f3d0d2df59a7b5","observation_id":"aac97f51-7bd4-4918-8927-ee99299ad8d1","resolution":{"observed_at":"2026-08-05T15:08:47.153146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4567.12345","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.650912Z","title":"Optimizing substance use treatment selection using reinforcement learning","venue":null,"work_id":"3a45c5e8-f6bc-4c3e-9ce3-aa0bebd9fb04","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.293276Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:2eb6a278574d06a69cab035b7b5f2c7be088467c64310d6c99968e3d32dca1d5","observation_id":"e22aeca8-1d8b-4f78-b0e1-d98989a7c2f6","resolution":{"observed_at":"2026-08-05T15:08:56.655360Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.460205Z","title":"Using artificial intelligence to learn optimal regimen plan for alzheimer’s disease","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.460205Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:8e37b19ad94546f39b11a79dbe65840121a75f73011bf5a5e2ce3b253a2631fb","observation_id":"0c6af5c0-b2a5-4251-844c-9efb9cfe827d","resolution":{"observed_at":"2026-08-05T15:08:47.460205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.619876Z","title":"Reinvent 2.0: an ai tool for de novo drug design","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.619876Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a02f5a69e47e05ba520bdc6860daf54aad807b077c37947b124f11229adee296","observation_id":"6091a871-c6fa-44c3-bae7-b51c3228b28a","resolution":{"observed_at":"2026-08-05T15:08:47.619876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.776802Z","title":"Trans- forming health care with artificial intelligence: redefining medical documentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.776802Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c07d6c5eb52024c59dc8d32d44beb89aa5eb743a938fe7ca02ff5d8773db7dfc","observation_id":"bb124c55-b6be-4359-961e-97d9a7e995b5","resolution":{"observed_at":"2026-08-05T15:08:47.776802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15217","last_updated":"2023-09-11T17:25:24Z","snapshot_observed_at":"2026-08-03T19:11:09.671782Z","submitted_at":"2023-07-27T22:29:25Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15217","snapshot_observed_at":"2026-08-05T15:08:47.910667Z","title":"Open problems and fundamental limitations of reinforcement learning from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.910667Z"},"links":{"cited_paper":"/paper/2307.15217","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:6217aa93f6f808a09fd486c32967f701c901290409aa258cf90e55caf3d024b5","observation_id":"05948fb1-cc9e-4c62-833a-44cbbf013ac9","resolution":{"observed_at":"2026-08-05T15:08:47.910667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.074904Z","title":"Implementing machine learninginhealthcare—addressingethicalchallenges.NewEngland Journal of Medicine 378, 981–983","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.074904Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:581ae634bd9b5743ec8f6ca3e4330ed0aa9a7a2936df835f4df0545c46ca8bbb","observation_id":"35edb42d-83a8-4ab1-80b4-a818869af8dc","resolution":{"observed_at":"2026-08-05T15:08:48.074904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-01T22:10:49.555742Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-05T15:08:48.201481Z","title":"Rlhf de- ciphered: A critical analysis of reinforcement learning from human feedback for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.201481Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:84e4cd053fbd1ee221f756785852cf96351e8917f3b6bc15554afc70e69ef616","observation_id":"fb30ccd4-5103-4e0e-9e52-32b2ea97598a","resolution":{"observed_at":"2026-08-05T15:08:48.201481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.352812Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.352812Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:3e38803ebba14c09295781f611d94387767288b0a1dc5a47e5aad70bf820722e","observation_id":"d2f31642-00c0-4266-9f7e-5edb5d970070","resolution":{"observed_at":"2026-08-05T15:08:48.352812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.521405Z","title":"Event-triggered drug dosage control strategy of immune systems via safe integral reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.521405Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ef6d74e3f7c8069fecbe28d1ccb3d0a8c8150a6b47f22c2ae4e20cc83f64382e","observation_id":"3666ef78-a8b8-44f4-a567-a7c2043cb72c","resolution":{"observed_at":"2026-08-05T15:08:48.521405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.31804","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.548948Z","title":"Reinforcement learning based diagnosis and prediction for covid-19 by optimizing a mixed cost function from ct images","venue":null,"work_id":"9b8b22bd-dfaa-4868-86d7-3cda7dec77c7","year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.740315Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:3dc0d94c1f87f7833e0c4d20956ce3df7ccffca7c89cbbfea15c17dc6da083fe","observation_id":"bac48f58-0f57-46ed-866d-a93d425e7dc3","resolution":{"observed_at":"2026-08-05T15:08:56.553558Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.906071Z","title":"A model-based hybrid soft actor-critic deep reinforcement learning algorithm for optimal ventilator settings","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.906071Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ee8aef10c35108eb9f518059d82b9f624e669988af06bbd67104df06775699cb","observation_id":"e5bac7b2-e9b6-4598-9917-bdb9067be55d","resolution":{"observed_at":"2026-08-05T15:08:48.906071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10280","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.476626Z","title":"Teleconsultation dynamic scheduling with a deep reinforcement learning approach","venue":null,"work_id":"bea7d973-2bb7-44e6-adcc-3f0843900b76","year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.074214Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ebcab4b2ec1c5a210caaf2e46bdcc3e27e304559398e19f33d2d0fdd2c1a8c01","observation_id":"25ad33e0-be33-4dd9-aaec-03991d127bff","resolution":{"observed_at":"2026-08-05T15:08:56.480704Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.240722Z","title":"An online trajectory guidance framework via imitation learning and interactive feedback in robot-assisted surgery","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.240722Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:86d721ecfefc448a11499eee95128f63f195d6d3fb4aa8f6e74d8c9a7eb77d1e","observation_id":"3e58feb5-2882-45c2-b14c-e83605e239b6","resolution":{"observed_at":"2026-08-05T15:08:49.240722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06869","last_updated":"2025-02-08T05:30:31Z","snapshot_observed_at":"2026-08-08T19:12:44.055177Z","submitted_at":"2025-02-08T05:30:31Z","title":"A Survey on Explainable Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06869","snapshot_observed_at":"2026-08-05T15:08:49.409444Z","title":"A survey on explainable deep reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.409444Z"},"links":{"cited_paper":"/paper/2502.06869","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:8847d4e8d3de5fe896d6c7d4d3c92b33f96de1519641209bb45b46034e7a4d95","observation_id":"f13abb6d-7170-4bb9-be00-4edc0e906c68","resolution":{"observed_at":"2026-08-05T15:08:49.409444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.535441Z","title":"Deep reinforcement learning extracts the optimal sepsis treatment policy from treatment records","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.535441Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9dd6a0d9fbbf6d2ca067e3dff753df2f7242f2b79cba1a21715777e1e521eeaf","observation_id":"b43e4a4b-7ab9-46f9-a0ed-9f8dda7df9c9","resolution":{"observed_at":"2026-08-05T15:08:49.535441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11973","last_updated":"2022-09-27T10:04:29Z","snapshot_observed_at":"2026-08-07T21:51:58.025112Z","submitted_at":"2018-05-30T13:56:06Z","title":"MolGAN: An implicit generative model for small molecular graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11973","snapshot_observed_at":"2026-08-05T15:08:49.648115Z","title":"Molgan: An implicit generative model for small molecular graphs","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.648115Z"},"links":{"cited_paper":"/paper/1805.11973","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9f85a8955e10347bf5ab9b71108caffd0815b75f55179750ee05f98bdece5fd4","observation_id":"742a106e-41de-4d76-8247-40348bffd9fc","resolution":{"observed_at":"2026-08-05T15:08:49.648115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.748376Z","title":"Advances and applications in inverse reinforcement learning: a comprehensive review","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.748376Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d6fbb1fd47450d9c43b519b6b8b26a07aa4b0e01aac10d029f66b5ae21aa339f","observation_id":"5cc1dbc4-185f-4992-9d27-27eab8889441","resolution":{"observed_at":"2026-08-05T15:08:49.748376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.913400Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.913400Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ac03136fa26ac94ae28160b2a5ae4f22952d5d1c4dbcdf0552015b89e985141a","observation_id":"2fa4e6af-a59e-4a62-af2c-7d3eefdffcf9","resolution":{"observed_at":"2026-08-05T15:08:49.913400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.230054Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.230054Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:5f2eeddafa73ed06255c281df58c6d46236ba53862c42d775ced56076a60ce48","observation_id":"4a3735ff-e04f-4bec-943d-8ff28b55dec3","resolution":{"observed_at":"2026-08-05T15:08:50.230054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.341927Z","title":"Situation-dependentcausalinfluence-basedcooperativemulti-agent reinforcementlearning,in:ProceedingsoftheAAAIConferenceon Artificial Intelligence, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.341927Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:4a2e375e1ad70b7bf08e411bb2082c4d9bf0badec03208bb193943bb862258b4","observation_id":"5486b722-25a7-4122-86c9-b969329d3eec","resolution":{"observed_at":"2026-08-05T15:08:50.341927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.495504Z","title":"Patient-specific sedation management via deep reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.495504Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d4e93f509d460f5349652d86604ded252c6a6223d545fb138581460ff55beda9","observation_id":"b83e3b9d-9db4-456d-a0e3-f8468e16e8b2","resolution":{"observed_at":"2026-08-05T15:08:50.495504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.520252Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.520252Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:20c36c48847392e0a040c44f8d83a81d05885240b55b7473e16c740d6ab764d7","observation_id":"db12d268-7851-4cc8-ad65-c6f449352355","resolution":{"observed_at":"2026-08-05T15:08:50.520252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.33517","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.402519Z","title":"Learn from safe experience: Safe reinforcement learning for task automation of surgical robots","venue":null,"work_id":"a6b601a1-4d90-4ad4-ac6f-74ad990add62","year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.523040Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:16c0f4334e4634d7aae6431309bb68ad8d01ab67cb691f2abbd8b3234e890826","observation_id":"ef07fff5-0892-4478-9c95-5d74c023d9ac","resolution":{"observed_at":"2026-08-05T15:08:56.407196Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32548","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.340745Z","title":"Sim-to-real surgical robot learningandautonomousplanningforinternaltissuepointsmanipu- lationusingreinforcementlearning","venue":null,"work_id":"31482e36-06ed-4902-896e-1ac40e6c90b0","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.526338Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e77669846e10526429767b046791c24379528ad0dcca8e5b8165b4b9d9e8ed94","observation_id":"46885983-7b1c-4932-a253-4200e1858491","resolution":{"observed_at":"2026-08-05T15:08:56.345168Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08123","last_updated":"2025-02-12T05:05:40Z","snapshot_observed_at":"2026-08-08T10:18:40.563686Z","submitted_at":"2025-02-12T05:05:40Z","title":"Provably Robust Federated Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08123","snapshot_observed_at":"2026-08-05T15:08:50.598526Z","title":"Provably robust federated reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.598526Z"},"links":{"cited_paper":"/paper/2502.08123","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:12633aa800be5da8e39a502e37c5a4ef6ede249b5262a0e2221c576bb762fd3d","observation_id":"1562e15c-6ee6-4560-83b0-290f3d01cf64","resolution":{"observed_at":"2026-08-05T15:08:50.598526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.764408Z","title":"Towards trustworthy automatic diagnosis systems by emulating doctors’ reasoning with deep reinforcement learning, in:AdvancesinNeuralInformationProcessingSystems,pp.24502– 24515","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.764408Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:0b58828b322c1ccc95259a2c54900294e24e8b50c14014b94e6acea82d85ac39","observation_id":"fe9a056c-9103-4bed-90ac-bb5732e07b49","resolution":{"observed_at":"2026-08-05T15:08:50.764408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.928847Z","title":"More robust doubly robust off-policy evaluation, in: International Conference on Machine Learning, PMLR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.928847Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ca1cb73115aaa6283c777a256929df0c7e6c7ab4af4d67b60b51b71416b678bf","observation_id":"73f2a626-8e68-4b1e-9254-4467c3615fa8","resolution":{"observed_at":"2026-08-05T15:08:50.928847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.053088Z","title":"Semi-markov offline reinforce- ment learning for healthcare, in: Conference on Health, Inference, and Learning, PMLR","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.053088Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9f03432f9d6e164afc0b008196ecfb05b9c875fe888237e228ef4311772f1954","observation_id":"cd7a958b-7eda-4cd4-bc8a-3ce2e193ebdb","resolution":{"observed_at":"2026-08-05T15:08:51.053088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04408","last_updated":"2025-02-06T09:51:28Z","snapshot_observed_at":"2026-08-09T16:59:50.126548Z","submitted_at":"2025-02-06T09:51:28Z","title":"Transforming Multimodal Models into Action Models for Radiotherapy","version":1},"cited_work":{"arxiv_id":"2502.04408","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04408","snapshot_observed_at":"2026-08-05T15:08:56.257305Z","title":"Transforming Multimodal Models into Action Models for Radiotherapy","venue":"cs.LG","work_id":"3aa86110-3e30-4f14-9a8d-74d4cb0fd2d5","year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.209296Z"},"links":{"cited_paper":"/paper/2502.04408","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:0a8a8c5ba473961270a147f613856ea5df70268aecb2998438aa26eb98a72b51","observation_id":"769466d0-e276-4370-8ff5-85c410129cff","resolution":{"observed_at":"2026-08-05T15:08:56.260496Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.372021Z","title":"Off-policy deep rein- forcementlearningwithoutexploration,in:Internationalconference on machine learning, PMLR","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.372021Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9720c9981361d1b5adab09444ee483fa5cd34632e425e68b98b8d49508826a89","observation_id":"3e5e4067-a4cd-483a-b3c6-03cbccb71ba7","resolution":{"observed_at":"2026-08-05T15:08:51.372021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04032","last_updated":"2020-03-31T15:57:08Z","snapshot_observed_at":"2026-07-06T08:50:01.519038Z","submitted_at":"2020-01-13T01:55:50Z","title":"POPCORN: Partially Observed Prediction COnstrained ReiNforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04032","snapshot_observed_at":"2026-08-05T15:08:51.538487Z","title":"Popcorn:Partially observed prediction constrained reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.538487Z"},"links":{"cited_paper":"/paper/2001.04032","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:dfca4c8d0803a38f68620ff9b3ec61b3082d337330e6fc4bbd7581e271913af9","observation_id":"e988a8da-a1ac-4053-912b-c0ccce6c390f","resolution":{"observed_at":"2026-08-05T15:08:51.538487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.704602Z","title":"Learningtotreatsepsiswithmulti-outputgaus- sian process deep recurrent q-networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.704602Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:8b339f52e5d8531414ff941728800c391fa2f2f7bfa311c6de74531ff00ba779","observation_id":"ff631272-9b71-4e06-ba4d-c8386e7bcf86","resolution":{"observed_at":"2026-08-05T15:08:51.704602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.870300Z","title":"Ai-assisted warfarin dose optimisation with curate","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.870300Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:90b056d45fcfb03bf3800cae9feb502284a30c582b63459ed880df4e85628f7d","observation_id":"7dfdf40c-04ee-4847-a57e-6cd5bc0f639d","resolution":{"observed_at":"2026-08-05T15:08:51.870300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.025563Z","title":"Causal inference from cross-sectional earth system data with geographical convergent cross mapping","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.025563Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f607c70100e864137fe4023b6272a03979baf0ccf75a96e689e0eae1096e6030","observation_id":"0a6dd22b-d0ab-45cd-aac3-dfbe64f20f43","resolution":{"observed_at":"2026-08-05T15:08:52.025563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.143243Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.143243Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c149274da1044392e270d252c38685ebb6e675ad38c7dc50569699ffc7894347","observation_id":"506b35ad-7dfc-4eb2-8927-80258b6483a4","resolution":{"observed_at":"2026-08-05T15:08:52.143243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07123","last_updated":"2023-10-14T16:38:00Z","snapshot_observed_at":"2026-08-07T15:35:12.119233Z","submitted_at":"2023-10-11T01:52:42Z","title":"Off-Policy Evaluation for Human Feedback","version":2},"cited_work":{"arxiv_id":"2310.07123","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.07123","snapshot_observed_at":"2026-08-05T15:08:56.237798Z","title":"Off-Policy Evaluation for Human Feedback","venue":"cs.LG","work_id":"7de60153-2f13-446d-9b75-364b3a29d28b","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.429349Z"},"links":{"cited_paper":"/paper/2310.07123","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:3ab17578de310b9803b2af8c1fff1cc82a48f4722461afcb88808afd07228840","observation_id":"f4c763a9-2e22-4258-8798-ff30fdb9a862","resolution":{"observed_at":"2026-08-05T15:08:56.240949Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-00789-4","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.700742Z","title":"Personalized decision making for coronary artery disease treatmentusingofflinereinforcementlearning","venue":null,"work_id":"59c8bb38-5a8c-417a-a722-8a88f6c87b7f","year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.593805Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:34c3785b78b91bf101443a6baff3c24859b180af2e92f9e15f430edb5487986e","observation_id":"69fdbe3d-a7ed-445d-a750-2e244cb37e78","resolution":{"observed_at":"2026-08-05T15:08:54.703375Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.808475Z","title":"Personalizeddecisionmakingforcoronaryarterydisease treatmentusingofflinereinforcementlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.808475Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:57b6b0c122f79aa96cd6027763acff3b44c4fece13fbfdc72780203a7506397b","observation_id":"e802e6ad-0902-43d9-947e-af509c318701","resolution":{"observed_at":"2026-08-05T15:08:52.808475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.974903Z","title":"The false hope of current approaches to explainable artificial intelligence in health care","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.974903Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7eca7746743e86046f3a37458f14c6e949fba54371f792bec7cb250b00336c38","observation_id":"3085a92c-5619-42d8-8ad7-f85e1d7e9b8b","resolution":{"observed_at":"2026-08-05T15:08:52.974903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.093621Z","title":"Medications for analgesia and sedation in the intensive care unit: an overview","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.093621Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f04e4e32e2a5b0b6a81da3b926b97bcc04fb11a7865c745a56fea1f803db86b5","observation_id":"f4e51424-3561-4f69-8fc9-57d92c60f73b","resolution":{"observed_at":"2026-08-05T15:08:53.093621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.253680Z","title":"Guidelines for reinforcement learning in healthcare","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.253680Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d11d309894adb88d75f5c01e92cfa2138412ebe2d075f5ba5ac66a1508117cb2","observation_id":"8d8ff5ac-a924-4a3a-b9ef-038097fdded7","resolution":{"observed_at":"2026-08-05T15:08:53.253680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.449950Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.449950Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:18b3b9657b4a30dd086fc4136a654af3868279190f736b47fcd9841f2187e268","observation_id":"217d091d-76b3-4582-8906-5ae280ed2d21","resolution":{"observed_at":"2026-08-05T15:08:53.449950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.576781Z","title":"Machine learning with optimization to create medicine intake schedules for parkin- son’s disease patients","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.576781Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f8533c22fed7fb8c16dc71e5f7e432724b4802991d0e66b63d04653054d7496b","observation_id":"70d69ac7-097b-4d8c-876e-802fdb11a4f6","resolution":{"observed_at":"2026-08-05T15:08:53.576781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.703069Z","title":"Extubation after breathing trials with automatictubecompensation,t-tube,orpressuresupportventilation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.703069Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f49da3d5f58b0671d071c1ec1071f566cc789adfa53647e36c6cb3c0a5d2f663","observation_id":"3669b792-dfa2-4529-9881-a9ca02156779","resolution":{"observed_at":"2026-08-05T15:08:53.703069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.798275Z","title":"Sim2real rope cutting with a surgical robot using vision-based reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.798275Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:6c935586e21d23491dd8cf180b30941447f976243c4a56cfe8f44717b64ec673","observation_id":"8c4033f0-4c20-4f9f-8b70-085979bc71f8","resolution":{"observed_at":"2026-08-05T15:08:53.798275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.966709Z","title":"Evaluating the diagnostic performance of symptom checkers: Clinical vignette study","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.966709Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:bb72a6d9d4a03930f5e495541a354c0fcd2b151558add2f3c19b91740569fd3b","observation_id":"b51c75ed-f0d2-4bc6-989a-a31d77381147","resolution":{"observed_at":"2026-08-05T15:08:53.966709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.976377Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.976377Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:be7288afec0f32e3d141d6363f0ee4632aae1c2f6df1a11e2defa504a5e4c374","observation_id":"7edfe91b-04b0-46df-af36-0943cb0a3635","resolution":{"observed_at":"2026-08-05T15:08:53.976377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.979230Z","title":"Longi- tudinalchangesindiagnosticaccuracyofadifferentialdiagnosislist developed by an ai-based symptom checker: retrospective observa- tional study","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.979230Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:fd758277d1135089b3f0d2d5704ea021f29230ed88370e7fc1a637d24481be8f","observation_id":"9a5496cb-2bef-42c8-a8db-13f8888227f6","resolution":{"observed_at":"2026-08-05T15:08:53.979230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.981906Z","title":"Investigatingthe potential of reinforcement learning and deep learning in improving alzheimer’s disease classification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.981906Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:93aec97a49d7be330aa5ee34e42709f9ba0483056277ddc781b74f7009befdd3","observation_id":"c58fb827-8b84-4716-8840-7fbf995271e4","resolution":{"observed_at":"2026-08-05T15:08:53.981906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.984249Z","title":"Deep recurrent q-learning for partially observable mdps., in: AAAI fall symposia, p","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.984249Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:bd8d737a17d020b74b2e889d3dcd1200c2a11e6a8bbec4939d955c9fb05e9042","observation_id":"21d8895a-592e-4074-908e-0d23f3403fe4","resolution":{"observed_at":"2026-08-05T15:08:53.984249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/mwc.001.2000345","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.692418Z","title":"IEEE Wireless Communications 28, 6–11","venue":null,"work_id":"84b1d9bd-b494-4780-b688-a00aa35e526c","year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.986690Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:375b137e6c76db68ab2de8bda40c10c9dae0ece6d5914872c52cad0a834fd770","observation_id":"852e8429-f5c3-48c2-8ba2-33dcee4453d3","resolution":{"observed_at":"2026-08-05T15:08:54.695502Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.989409Z","title":"Understanding the patient perspective of epilepsy treatment through text mining of online patient support groups","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.989409Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9ad4450fb25441b7352cf271d62465a2a8071dd24ca1626f9c131ef8cd8d362a","observation_id":"9d591e9d-f25a-43f1-b704-cb5731291dcb","resolution":{"observed_at":"2026-08-05T15:08:53.989409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.991765Z","title":"A survey of large language models for healthcare: fromdata,technology,andapplicationstoaccountabilityandethics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.991765Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:22cb672ac4c144660321700a2ef871ef900897cecba666ac33a152200d0a3d8f","observation_id":"4b39b70d-7f8b-4394-95d3-44059f428e1e","resolution":{"observed_at":"2026-08-05T15:08:53.991765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.994388Z","title":"A blockchain-based scheme for secure data offloading in healthcare with deep reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.994388Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:cc09712c449fbbe70ceb5c3c04220c0084f7312ad7ebef809c8300f4a7f4e343","observation_id":"f3ecea35-f958-4503-8589-439cd2475a0b","resolution":{"observed_at":"2026-08-05T15:08:53.994388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10000","last_updated":"2023-04-19T22:37:12Z","snapshot_observed_at":"2026-08-08T11:53:44.134294Z","submitted_at":"2023-04-19T22:37:12Z","title":"Model Based Reinforcement Learning for Personalized Heparin Dosing","version":1},"cited_work":{"arxiv_id":"2304.10000","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.10000","snapshot_observed_at":"2026-08-05T15:08:56.226115Z","title":"Model Based Reinforcement Learning for Personalized Heparin Dosing","venue":"math.OC","work_id":"1e7f34ed-bbbe-48de-89be-c2dd37c81e7c","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.997414Z"},"links":{"cited_paper":"/paper/2304.10000","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c7ce5725aea248c8c1330fc328cc826505d74d10307080e4485c5a721a90979b","observation_id":"824d38b9-8200-4ef6-bc6c-c523197c01ff","resolution":{"observed_at":"2026-08-05T15:08:56.229502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.000288Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.000288Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:2e4a18a583962227734c98390afbf50244c59176c4dd76222a340f6d1e9633ba","observation_id":"8b459f2e-cdd7-43ea-9fa8-57e3d2f96b1c","resolution":{"observed_at":"2026-08-05T15:08:54.000288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.006238Z","title":"Long short-term memory","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.006238Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e33c66663e3c9e10fcd9e3f9e34f70f0ec43d6cac06edb5f9b356a46360028e4","observation_id":"de23203d-b3ef-404d-8444-29244d374dde","resolution":{"observed_at":"2026-08-05T15:08:54.006238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.008732Z","title":"Vime: Variational information maximizing ex- ploration","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.008732Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9ca13ae99accd71739231f04331ae1fb3e79ea4b804993fe83bfe50e4ca0332f","observation_id":"9ec8c2f9-7553-4dc7-92a6-22fe3bf8c75c","resolution":{"observed_at":"2026-08-05T15:08:54.008732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.011303Z","title":"Dynamic programming and markov processes","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.011303Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a1021aaa33c76afe518c4b8bf8ce0a289dc029348cca441b1792cbeeaff104e4","observation_id":"9cdb71e4-69ba-435c-a973-23b926d2da8e","resolution":{"observed_at":"2026-08-05T15:08:54.011303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.013931Z","title":"Reinforcement learning for sepsis treatment: A continuous action space solution","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.013931Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7db00a653add9c99efc6e38ecf59b8549720c3feda161b4f223625286c7561be","observation_id":"06330450-0716-46e7-a308-0da67d5660f2","resolution":{"observed_at":"2026-08-05T15:08:54.013931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.016430Z","title":"Deep variational reinforcement learning for pomdps, in: International conference on machine learning, PMLR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.016430Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c798ab4ec06b1d39883524210e352d5ac17c335e624d4a32c56236ebb69b12e7","observation_id":"a3d1bdd2-c4f5-41fc-84b6-58703c74f244","resolution":{"observed_at":"2026-08-05T15:08:54.016430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.019264Z","title":"Personal- ized insulin dosing using reinforcement learning for high-fat meals and aerobic exercises in type 1 diabetes: a proof-of-concept trial","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.019264Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:584f504720df124fd2f26d9733ebfdbb817c16327f7b15653ff13a49dccaa244","observation_id":"712ed2eb-bccf-4f04-9632-7373db863552","resolution":{"observed_at":"2026-08-05T15:08:54.019264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.021562Z","title":"Irl for restless multi-armed bandits with applications in maternal and child health, in: PRICAI 2024: Trends in Artificial Intelligence, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.021562Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:b59aade5d63dcbbdced02dfdbef63c94402c2f0e35edefc0821d62f9aec2503b","observation_id":"6ac6a665-dc2a-47db-9555-1fdb109692b5","resolution":{"observed_at":"2026-08-05T15:08:54.021562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.023899Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.023899Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:8bd2cafe122de03b3ed4e16e7b73d9441d3960e4e6e84e10b63207fa639e9f10","observation_id":"f4be8083-322c-442b-a950-f45d701752cf","resolution":{"observed_at":"2026-08-05T15:08:54.023899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.026439Z","title":"Basal-bolus advisor for type 1 diabetes (t1d) patients using multi-agent reinforcement learning (rl) methodology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.026439Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:275641e6866fa01dbd860d93b8418314e0fc1d2678aa629c0356a1854a874dc6","observation_id":"55a5964d-9f84-4c36-b53d-ef2a386cebb0","resolution":{"observed_at":"2026-08-05T15:08:54.026439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.029482Z","title":"A primer on reinforcement learning in medicine for clinicians","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.029482Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:078311d9d8e9bbfabb74b0ad0df0a4659c6fc2172dec23f6015526380f5ee66b","observation_id":"093ec56e-2839-4175-b3ec-ba54ac892f7e","resolution":{"observed_at":"2026-08-05T15:08:54.029482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-03T06:34:42.243765Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-05T15:08:54.032086Z","title":"Pku-saferlhf: Towards multi-level safety alignment for llms with human preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.032086Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e0558d363758cafeed09ba4f88a13bfd27ca8faae587e1748ee9bcd94c7d2276","observation_id":"c95821df-2fb0-4028-9f2c-4fb40de35681","resolution":{"observed_at":"2026-08-05T15:08:54.032086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.035230Z","title":"Safe reinforcement learningforsepsistreatment,in:2020IEEEInternationalconference on healthcare informatics (ICHI), IEEE","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.035230Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:aaf11c048da95e8d9cf147ca4019765d3b1b3f6a0727174b9f33c199e2bd8abf","observation_id":"ef362d3e-c085-4daa-bf04-94c6db3a5996","resolution":{"observed_at":"2026-08-05T15:08:54.035230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.037864Z","title":"Doubly robust off-policy value evaluation for reinforcement learning, in: International conference on machine learning, PMLR","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.037864Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:914e7f94b4d70f602ac25b27a5d5fe2e2ae564d046968752d2ced98f4ce4cdd5","observation_id":"d9108e7c-05c5-44e0-864a-a7b8b69b4d18","resolution":{"observed_at":"2026-08-05T15:08:54.037864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.040899Z","title":"Opti- maltreatmentstrategiesforcriticalpatientswithdeepreinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.040899Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:fdabbcfcbafcc115f28892a8a6c2bba6164dac05f98fce57f2bb577fe410379b","observation_id":"e761e101-baed-46dc-a56f-3dc605eac58d","resolution":{"observed_at":"2026-08-05T15:08:54.040899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.043409Z","title":"The malmoplatformforartificialintelligenceexperimentation.,in:Ijcai, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.043409Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:3864d2e88c57f333329533586b751c05c8e677e14b470a5eb3406a12f633b895","observation_id":"0e845017-4203-4b96-b0f8-8cb8c4f320be","resolution":{"observed_at":"2026-08-05T15:08:54.043409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.046328Z","title":"Reinforcement learn- ing: A survey","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.046328Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9634aba1d813145aa34f16922f290f952a17ae2db980f6f088d7a027a3d1e54d","observation_id":"683b236b-9637-4ab3-af63-06ed314cd503","resolution":{"observed_at":"2026-08-05T15:08:54.046328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v32i1.11902","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.683366Z","title":"Context-aware symp- tomcheckingfordiseasediagnosisusinghierarchicalreinforcement learning","venue":null,"work_id":"2c833d22-79ea-44ad-a99f-f1bf847c626e","year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.049323Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d68b896ef2ea82a6a2cdad5bfa2927f045e889d55762ce5cc2487e9670e351dc","observation_id":"e237829f-6243-42f4-9cc1-0734607f13b2","resolution":{"observed_at":"2026-08-05T15:08:54.686460Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.051882Z","title":"Elrl-md: a deep learning approach for myocarditis diagnosis using cardiac magnetic resonance images with ensemble and reinforcement learning inte- gration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.051882Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:08f94e51532cdc310453476c39c3dd43620c1ac1dcea345d7500f7c1e696ea9f","observation_id":"23ad0529-b2b4-4db9-84cc-11ed9c1ab69e","resolution":{"observed_at":"2026-08-05T15:08:54.051882Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.054418Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.054418Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:0ae7c64c60a131424a771b1984eebe0aa026da0f445562685fc1e4acd89e1da0","observation_id":"df4d1ce9-4b95-43ca-8658-4d048e645232","resolution":{"observed_at":"2026-08-05T15:08:54.054418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.056693Z","title":"Reinforcement learning for clinical applica- tions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.056693Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:245ff97c155832720545a4ab1d450987c1a724e163f09e14714f90c622500058","observation_id":"6666043a-e222-4905-b5c8-2acad0c60a8e","resolution":{"observed_at":"2026-08-05T15:08:54.056693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11235","last_updated":"2020-11-23T06:37:08Z","snapshot_observed_at":"2026-08-07T15:44:48.506500Z","submitted_at":"2020-11-23T06:37:08Z","title":"An Empirical Study of Representation Learning for Reinforcement Learning in Healthcare","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11235","snapshot_observed_at":"2026-08-05T15:08:54.059609Z","title":"An empirical study of representation learning for rein- forcement learning in healthcare","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.059609Z"},"links":{"cited_paper":"/paper/2011.11235","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:757a1bcedf1a0f1dd8ba3bf793c9802ff1833e3dfd2a3e483b4e3e7816be6fe8","observation_id":"ae999c9d-b19a-47b4-b869-409ebd24dffd","resolution":{"observed_at":"2026-08-05T15:08:54.059609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.062323Z","title":"Physiological Measurement 42, 025006","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.062323Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7c8099dad079c24d1aed9f1ba11818f3f6e352c2f79a3e33606a8852edc3aff8","observation_id":"d77e2c6d-8fc8-4689-a30e-8a1993a88c9f","resolution":{"observed_at":"2026-08-05T15:08:54.062323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.065072Z","title":"Building a personalized messaging system for health intervention inunderprivilegedregionsusingreinforcementlearning.,in:IJCAI, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.065072Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ce55405323914e9aaf0d5c11290bdd4d70cdb5cf3f665fc266ed4cb1ed484f30","observation_id":"e7c08f9a-b067-46ac-b208-998784b5b0ab","resolution":{"observed_at":"2026-08-05T15:08:54.065072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.067425Z","title":"The artificial intelligence clinician learns optimal treatment strategies for sepsis in intensive care","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.067425Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d1a1c14ef7761ae14cc4e1ff543c6db66639fda39f21986128b8495829e6e5c2","observation_id":"57bba718-eecc-4af9-ac1a-cff4bc737e2a","resolution":{"observed_at":"2026-08-05T15:08:54.067425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.069892Z","title":"Towards safe mechanical ventilation treatment using deep offline reinforcement learning, in: Proceedings of the AAAI Conference on Artificial Intelligence, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.069892Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:dc50ceaf4d6ae6608fb7f26e403f24c604eaf8132e9a0d4045f10618ca887a7a","observation_id":"6790d2ef-8325-4f2f-abc1-19595e0f4c2d","resolution":{"observed_at":"2026-08-05T15:08:54.069892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.072593Z","title":"Designanefficientvarmalstmgru model for identification of deep-fake images via dynamic window- based spatio-temporal analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.072593Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:15f74a1721e400233fa6fa76e1db518b105f988547c1e6bf3b8bb12996a71c0d","observation_id":"cb5e42dd-628c-4de8-97c9-5f4cc4c435a7","resolution":{"observed_at":"2026-08-05T15:08:54.072593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.075126Z","title":"Hierarchical deep reinforcement learning: Integrating temporal ab- straction and intrinsic motivation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.075126Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:b9e21535defc6cb6ffb46319ba1f5a90d40d08037820c31d33e7d00e7d73a04b","observation_id":"98cc2015-24a9-4be6-85f8-5fa01a6d0d5b","resolution":{"observed_at":"2026-08-05T15:08:54.075126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.077569Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.077569Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d1d32325271f0e3c2449b167343680711a15c7d6e2b41f3b38c62935bcf4e3bd","observation_id":"5983922a-f426-4bc6-a0c5-7e22642a05fe","resolution":{"observed_at":"2026-08-05T15:08:54.077569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.080066Z","title":"Artificial intel- ligence in disease diagnosis: a systematic literature review, synthe- sizing framework and future research agenda","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.080066Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:3a1eb60ff073dcf90ff6b43504461c6392eb4f1e886bcd74a1723d6f33b15acc","observation_id":"b5b774aa-4bd5-45b3-983b-9d538bdeb4b8","resolution":{"observed_at":"2026-08-05T15:08:54.080066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.082549Z","title":"Mobile-fog-cloud assisted deep reinforcement learning and blockchain-enable iomt system for healthcare workflows","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.082549Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:b132f90236779c8fa514a5441217f1b6065c1dc0382302343939349d20432744","observation_id":"b4376bf6-a559-48cd-90b5-c0e0a71f90a5","resolution":{"observed_at":"2026-08-05T15:08:54.082549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.084801Z","title":"Fiber-optics iot healthcare system based on deep reinforcement learning combi- natorial constraint scheduling for hybrid telemedicine applications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.084801Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:88059935cdd4bbbf00f23f42f5c1824d2ea4a190aca56fe7e774e0b7f691a1c8","observation_id":"52ceb5f8-27ac-4562-9401-fb68f0a62944","resolution":{"observed_at":"2026-08-05T15:08:54.084801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.087214Z","title":"Data-drivenhospitalsstaffandresourcesalloca- tion using agent-based simulation and deep reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.087214Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a5fc788df22c9e150f000c35b88f3d1fd91363144718e64e28a8f350dc5cb00e","observation_id":"9c2f2111-ba65-41e9-9b30-c2096e9b08b8","resolution":{"observed_at":"2026-08-05T15:08:54.087214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":87,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":281},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 281 outbound references and 1 inbound Pith citation observation for arXiv:2508.21101."}