{"as_of":"2026-08-15T21:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d3165589a9cb4a6a22570cae6a987e6ceeed048dd029dd1b6d4d63735b5d603","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:04:38.869043Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17056/citation-record","integrity":"/paper/2507.17056/integrity","json":"/paper/2507.17056/citation-record.json","paper":"/paper/2507.17056"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.958613Z","title":"Following (Matsson et al., 2024a), we restricted the analysis to classes of DMARDs rather than individ- ual drugs","venue":null,"work_id":"f2b2c88a-9ce3-4c4c-a9a7-720c693f8320","year":2018},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.863588Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:11ff09fd25b1df46294615c898b8f78fc9c810b627fb95231052ed390971e275","observation_id":"b0ab8493-e16b-49a2-ba25-e39cd2af6e56","resolution":{"observed_at":"2026-08-06T15:04:38.961367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.08037","last_updated":"2017-11-24T07:02:24Z","snapshot_observed_at":"2026-08-14T20:12:05.444193Z","submitted_at":"2017-11-20T04:19:49Z","title":"The Doctor Just Won't Accept That!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.08037","snapshot_observed_at":"2026-08-06T15:04:38.842866Z","title":"The doctor just won’t accept that! arXiv preprint arXiv:1711.08037 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.842866Z"},"links":{"cited_paper":"/paper/1711.08037","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:4e1ea6e43a591f2da593f17af8cbe089c3c4e8848f104bdf647a767b6bb5915a","observation_id":"1d254811-2815-4910-899a-99d12207bd4b","resolution":{"observed_at":"2026-08-06T15:04:38.842866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.950312Z","title":null,"venue":null,"work_id":"80fddb3d-ff31-4339-841b-debd6b4e19d8","year":2015},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.866370Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:f05f10d826b953e8638257dd6d455efca3f065feafff7142236a2fd1c93398cd","observation_id":"a7884742-40dd-4060-ab59-e0556f900d3f","resolution":{"observed_at":"2026-08-06T15:04:38.953006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.940315Z","title":"For the other methods—DQN, BCQ, and CQL— we used the implementation provided by Luo et al","venue":null,"work_id":"1a212341-ef43-4510-b149-7cdc61cb96f7","year":2024},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.869043Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:e5fdea2897938229e2e029c96e19fc2d99f4a3b0258f23e393b1e00aefe45c33","observation_id":"80477ffe-2319-429d-afda-65fcc8901c8c","resolution":{"observed_at":"2026-08-06T15:04:38.944333Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.984014Z","title":"Behavioural cloning for driving robots over rough terrain","venue":null,"work_id":"ecf42c91-bdef-47f0-8ffd-629fae0b8326","year":2011},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.855301Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:60b7ce0605d7c08aeb6cc4f7d601b7fc1b767a43b8a5a0f2b3ce48a7bc98a370","observation_id":"d409f753-1c02-4ca4-ab51-45312fdba3bd","resolution":{"observed_at":"2026-08-06T15:04:38.986896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01180","last_updated":"2019-07-02T05:51:04Z","snapshot_observed_at":"2026-08-05T03:40:23.581115Z","submitted_at":"2019-07-02T05:51:04Z","title":"Conservative Q-Improvement: Reinforcement Learning for an Interpretable Decision-Tree Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01180","snapshot_observed_at":"2026-08-06T15:04:38.852237Z","title":"Conservative Q- improvement: Reinforcement learning for an interpretable decision-tree policy","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":1983,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.852237Z"},"links":{"cited_paper":"/paper/1907.01180","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:4864abcc0775b8cbeaefce48ce1ad64be188a1551257d1027bbb692762766c3e","observation_id":"d4132ec1-52da-45e4-ba46-67765db35e5c","resolution":{"observed_at":"2026-08-06T15:04:38.852237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09602","last_updated":"2017-11-27T09:49:57Z","snapshot_observed_at":"2026-08-14T20:09:56.346448Z","submitted_at":"2017-11-27T09:49:57Z","title":"Deep Reinforcement Learning for Sepsis Treatment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09602","snapshot_observed_at":"2026-08-06T15:04:38.849175Z","title":"Deep reinforcement learning for sepsis treatment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.849175Z"},"links":{"cited_paper":"/paper/1711.09602","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:99122f272e02c699e45c1976e817b60b451cd2d8008c54541a24b93efcee9889","observation_id":"056f7f80-8196-40e6-867b-e795428858a7","resolution":{"observed_at":"2026-08-06T15:04:38.849175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:39.000798Z","title":"Distilling deep rein- forcement learning policies in soft decision trees","venue":null,"work_id":"2918ef65-6c8e-449c-a907-66aba997df62","year":2019},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.829990Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:28fb5327ee6defd57d92205f45bb0f785f9ecda9c6e57f529d03a845db4c377d","observation_id":"4641c43b-3c3a-47de-86f6-3ade251ed508","resolution":{"observed_at":"2026-08-06T15:04:39.003648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.975345Z","title":"Smolen, Robert B.M","venue":null,"work_id":"c394ae9b-41e8-4411-960b-09157ce92844","year":2022},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.858179Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:1dd6d384238099df717be21e182dcc5aeabb43a5579da662aa5664da0bb716a3","observation_id":"af3dd4ac-89ef-411e-840f-26d72d465e11","resolution":{"observed_at":"2026-08-06T15:04:38.977980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.992391Z","title":"Off-policy deep reinforcement learning without ex- ploration","venue":null,"work_id":"17d27cc5-6af5-44d7-8260-f46b75bfaed5","year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.833477Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:f7abfe717d506fa0e5a78e6b0c7f6b1057af4357f2c1591794c5bb1efc200160","observation_id":"27778344-32cf-4392-a7e1-e54db046e05b","resolution":{"observed_at":"2026-08-06T15:04:38.995325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T15:04:38.839728Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.839728Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:6cded33be465b84b96c2ac4bf54c635eb8a5f311a4f02c7c7295fee6f1a2a486","observation_id":"467fabfc-7175-4e64-8fb1-6d1efb5a2c63","resolution":{"observed_at":"2026-08-06T15:04:38.839728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01685","last_updated":"2020-08-07T18:34:21Z","snapshot_observed_at":"2026-08-14T16:52:42.482023Z","submitted_at":"2019-04-02T22:10:44Z","title":"Measuring Calibration in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01685","snapshot_observed_at":"2026-08-06T15:04:38.845945Z","title":"Measuring calibration in deep learning","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.845945Z"},"links":{"cited_paper":"/paper/1904.01685","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:f8551066c14b21347740cbdd838a42f2dca8cbc8e5b47d8c107052705de72a55","observation_id":"b01d28c9-5d7b-4357-9db7-b5ef5a5cc74c","resolution":{"observed_at":"2026-08-06T15:04:38.845945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.966637Z","title":"Datasets Our experimental evaluation was based on two dis- tinct datasets related to the management of rheuma- toid arthritis (RA) and sepsis","venue":null,"work_id":"b0cedc65-b210-4dfe-8dc2-96b5f36d504c","year":2023},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.861017Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:de38584bbb9b30e3956cbcc5e483a56da1e2330fd2b0628fe3a4bb2fa43eb54b","observation_id":"8677122e-7a88-4289-ba20-b9c7e9dcdc09","resolution":{"observed_at":"2026-08-06T15:04:38.970031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12298","last_updated":"2018-05-31T02:56:26Z","snapshot_observed_at":"2026-08-14T19:09:12.316446Z","submitted_at":"2018-05-31T02:56:26Z","title":"Evaluating Reinforcement Learning Algorithms in Observational Health Settings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.12298","snapshot_observed_at":"2026-08-06T15:04:38.836400Z","title":"Evaluating reinforcement learning al- gorithms in observational health settings","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.836400Z"},"links":{"cited_paper":"/paper/1805.12298","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:fe543b8a2f1bf370bfac83773ab9ee7a292172cd41c126e8b8a75a03770d8bf9","observation_id":"22e4a638-523a-46ca-bf1f-f1a50b3792db","resolution":{"observed_at":"2026-08-06T15:04:38.836400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T05:09:18.630067Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2507.17056."}