{"as_of":"2026-08-13T11:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:111aab45656e1f01a4f93aa44efe994b49dedb266d1f0d0f7ecf250eaad25ca1","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:13:32.534554Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03606/citation-record","integrity":"/paper/2608.03606/integrity","json":"/paper/2608.03606/citation-record.json","paper":"/paper/2608.03606"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.517023Z","title":"When does return-conditioned supervised learning work for offline reinforcement learning? In Advances in Neural Information Processing Systems (NeurIPS), 2022","venue":null,"work_id":"59222ebc-bd66-4c19-a6b5-824e1acc14d8","year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:30.916113Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:55cf14f22401d1834dc69e4fcfc1e509c7beb69288c1933d28d2612171b70380","observation_id":"afc4603b-355a-40c4-8a58-d983a7be7eac","resolution":{"observed_at":"2026-08-05T16:13:34.586091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.343301Z","title":"Trialbench: Multi-modal ai-ready datasets for clinical trial prediction","venue":null,"work_id":"fc5c59aa-4db1-4e12-8079-590bc21a4fe5","year":2025},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:30.980647Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:0b1db8e2ca873defc98ed7e4fa67059d56a02d3ca41255893ff47e59015b095a","observation_id":"38f39604-1bfa-4b84-aa82-291ad7815dc3","resolution":{"observed_at":"2026-08-05T16:13:34.430927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.162530Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":"a1e2e435-7d67-4cfe-b76d-cb711d922965","year":2021},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.080200Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:dbd242eedd5bae14557545b43cb45ca5532630aaa2db25f7e98afe01a424f6c9","observation_id":"5da2eff5-4b16-4c94-b88a-ef16e1155ff8","resolution":{"observed_at":"2026-08-05T16:13:34.246840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.015205Z","title":"RvS : What is essential for offline RL via supervised learning? In International Conference on Learning Representations (ICLR), 2022","venue":null,"work_id":"31dd869d-fd50-4162-a378-c25f6c77abb4","year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.190307Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:4b196f71082cfbf95e7a22975d7bea3c1e03e384aa59795607e607171a5aa23d","observation_id":"1622e00c-6655-4a91-84e2-7a510dd0df6a","resolution":{"observed_at":"2026-08-05T16:13:34.084594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.841398Z","title":"M., and Sun, J","venue":null,"work_id":"500858ff-7ff8-46ca-aeef-2f471b33adf7","year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.328397Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:b34cbebe20093612635db0dc78b3f2dbbff11ed18ddde07a38a53a283f2e4a40","observation_id":"579859c7-4d9c-472b-9f29-69d511b9bfc7","resolution":{"observed_at":"2026-08-05T16:13:33.920918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.693419Z","title":"Biomni: A general-purpose biomedical ai agent","venue":null,"work_id":"2d3e1107-bead-437e-b08c-6666b6fbcf80","year":2025},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.425518Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:fb257bba2567b1f6a7249b226c025cd54c1fbc74abb67156ee5bbf9dd22557b0","observation_id":"f59a5af0-eaa2-41da-8b69-569bb770be4a","resolution":{"observed_at":"2026-08-05T16:13:33.765955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.512401Z","title":"Offline reinforcement learning as one big sequence modeling problem","venue":null,"work_id":"360479b8-3787-4de4-a7f3-bd8691c54618","year":2021},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.523538Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:7bead76b6c6cc971f7fee025dff25ab019ffa8b9aee8f7229cedbba1c40b9896","observation_id":"ca1d33fd-607d-4ac2-afec-17cb1960ada6","resolution":{"observed_at":"2026-08-05T16:13:33.601148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.357732Z","title":"S., Chen, F., Gong, C., Bracken-Clarke, D., Xue, E., Yang, Y., Sun, J., and Lu, Z","venue":null,"work_id":"146c86d7-6fa6-4a62-848f-ed6c3557c36a","year":2024},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.673635Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:a5d4e369195f58f8a9764840d4d67bfc15f796278a0499d89973d4e057a1f19d","observation_id":"b003f1de-35c9-4997-9668-436c8bb5d323","resolution":{"observed_at":"2026-08-05T16:13:33.416324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-13T07:57:56.087944Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-05T16:13:31.791314Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.791314Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:103cb3921d607ae914e05e4edb3b3bd0c293593579232820f2da298bb24c721f","observation_id":"6c72ebba-9545-4f59-9141-343fe579b2ea","resolution":{"observed_at":"2026-08-05T16:13:31.791314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05618","last_updated":"2022-04-12T08:25:34Z","snapshot_observed_at":"2026-08-10T10:00:12.091311Z","submitted_at":"2022-04-12T08:25:34Z","title":"When Should We Prefer Offline Reinforcement Learning Over Behavioral Cloning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05618","snapshot_observed_at":"2026-08-05T16:13:31.897892Z","title":"When should we prefer offline reinforcement learning over behavioral cloning? In International Conference on Learning Representations (ICLR), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.897892Z"},"links":{"cited_paper":"/paper/2204.05618","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:7df3c23c9d71f4f1fa040179a5071e422c4e9a715089d90396b55e493b84950b","observation_id":"944f50eb-2561-49dc-a84b-812052f33c30","resolution":{"observed_at":"2026-08-05T16:13:31.897892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-05T16:13:31.993261Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.993261Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:7e047e9f4caaf79146017bf23d9c0d39b2fb877fa2ef72228e52c576902642a3","observation_id":"31346935-d93e-4eef-a9ee-0716b4e983db","resolution":{"observed_at":"2026-08-05T16:13:31.993261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-05T16:13:32.092136Z","title":"Awac: Accelerating online reinforcement learning with offline datasets","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.092136Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:fb5f3262ebb3ffee044da1015c63c48b9300d9eb3c1124e2cd0acd057be317df","observation_id":"2c652392-baf9-4b45-99d8-a23efea3cc03","resolution":{"observed_at":"2026-08-05T16:13:32.092136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-05T16:13:32.177880Z","title":"B., Kumar, A., Zhang, G., and Levine, S","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.177880Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:9465567a01d7e8a7c46eafb92c7cb624283c1a763fd924c542ba2128e4240ed9","observation_id":"29627c24-ad87-4a42-975e-dc0a530d7dd2","resolution":{"observed_at":"2026-08-05T16:13:32.177880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.171185Z","title":"F., Maximo, M","venue":null,"work_id":"a90ded2f-5187-488e-ba4b-990fde809764","year":2023},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.262350Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:1e0b7b486f14b01b7255c7138e5935b3359eda6d3219da893c22a9cd9895a26c","observation_id":"a7a2ef60-d035-4892-8844-b40f0b341648","resolution":{"observed_at":"2026-08-05T16:13:33.263990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07960","last_updated":"2025-05-25T02:19:37Z","snapshot_observed_at":"2026-07-30T08:34:47.046912Z","submitted_at":"2024-05-13T17:38:53Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07960","snapshot_observed_at":"2026-08-05T16:13:32.341671Z","title":"Agentclinic: a multimodal agent benchmark to evaluate ai in simulated clinical environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.341671Z"},"links":{"cited_paper":"/paper/2405.07960","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:868bd545e381f4550d8108217bd00d20b552a2e1807206396eee2fdf24764d27","observation_id":"4dd17814-fe04-48aa-955f-5411bc480670","resolution":{"observed_at":"2026-08-05T16:13:32.341671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:32.983360Z","title":"and Kim, Y","venue":null,"work_id":"23f4f946-569f-4e0d-b7db-f8ab54138a88","year":2023},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.446109Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:73a5e7031657a12ba443059d0ef17864429756c3d1ca8db5e54f30f2a1bc6a6a","observation_id":"04eae1dd-7bdd-4e88-8e1d-141492700fc3","resolution":{"observed_at":"2026-08-05T16:13:33.067634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:32.789869Z","title":"T., Reed, S., Shahriari, B., Siegel, N., Merel, J., Gulcehre, C., Heess, N., and de Freitas, N","venue":null,"work_id":"fe38bf9f-0d3a-432f-b3b3-e54f611b90ce","year":2020},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.534554Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:7bfc22f8647ebce9e60238d07a66cd2401a834600b9b94f2f509f54045bd6625","observation_id":"6b935df0-b80e-450c-81b0-cf1d5b38c049","resolution":{"observed_at":"2026-08-05T16:13:32.848904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T10:39:15.224743Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2608.03606."}