Pith. sign in

Paper Citation Record · LEDGER

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search

As of 20 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2411.09722.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.09722 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T20:47:41.308466Z

measured 50 of 50 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

50 of 50 outbound references displayed

  • verified exact1
  • verified fuzzy21
  • unresolved27
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation baea27a8-b8a8-4b29-a92b-0d9ed4d63090 · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.962900Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.133523Z digest=sha256:52d87a97fa9eb85d24b6984a7c3dfe364e44ea9e22d785d4cb52548372ccf5e4

Observation c0b5c7d2-f0bb-4677-8a32-6d99c98dd0a8 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.953391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.138522Z digest=sha256:b4a7c9befec4923072c99ce2a8b8f5fc9631ccb3f8eb31041d8372b6fe029988

Observation 38a072be-3f9d-4f8c-b0f0-14065cc9b6d7 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.943477Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.142320Z digest=sha256:46bc5ee8752f773b771ecd35ba835d92bf33d26f469e43199009ad9cce039dbe

Observation 2c2c3844-7be9-45cc-b185-156081afaa58 · outbound

This paper cites Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.146371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.146371Z digest=sha256:cca5e2988791295df6d6e8407cd08543cd9654afc0a64d1854d95d471097f146

Observation f4dcf8f0-80de-487b-92f0-17e0e961f924 · outbound

This paper cites Iteratively Refined Behavior Regularization for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Iteratively Refined Behavior Regularization for Offline Reinforcement Learning

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-08-12T20:47:41.614831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.150335Z digest=sha256:f87b96328c2ed128315034cc04d182594249928aa904809c1d06103b327bb752

Observation 55695fe5-8b1b-4a25-b3d0-7feede4eeede · outbound

This paper cites Zhang, L.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Zhang, L

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.933634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.154072Z digest=sha256:a24b3024d58fe85c3adb8d82a135d04c3cd65edd24b352dafff9edd6e50e01de

Observation 88ed4f6e-9224-4677-adea-e8c74999192a · outbound

This paper cites Ernst, M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Ernst, M

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.923767Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.157701Z digest=sha256:a3cf3c8ae67e6c31c8960752e79ff5abd88af5ff31522e1bc6336edae9334e96

Observation 68c30bc7-28cd-44fa-b7ff-bbc6d7211145 · outbound

This paper cites Riedmiller.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.913203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.160746Z digest=sha256:f2bc6e9711058cf971f025496c9e3373c05bd8913d97489d0c09e1bbc410e63b

Observation d42e0400-740e-4db2-b6bd-78b866b1a99a · outbound

This paper cites Riedmiller, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller, T

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.903072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.164027Z digest=sha256:e2b8a4dba939a748aec3362c16500cf22fed8cac83f7792cb918010ca648291d

Observation ebb67969-2615-4c9d-9222-1b6d86edbf8b · outbound

This paper cites Lange, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Lange, T

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.893147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.167320Z digest=sha256:5b1884cb203609bbfa40d53299824b0e0e34c4d9f18935cccbe05546ad731751

Observation e1c42eff-c223-4ec1-a0f2-a158b5f0e0b3 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.883029Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.170526Z digest=sha256:6a10c1309922f303e40f9b506367aabd28a4e32edcda784b5d8d6732a830564d

Observation 19d16d6d-bcae-4f81-b986-7ca422082b74 · outbound

This paper cites Depeweg, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.872665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.173724Z digest=sha256:027eb30b2dc4bfb32b0a657a1a73c97066782c3b2c8187fc56f1bac7496d0c68

Observation f159b5a8-a407-464a-bbe5-2aa31e6b6c08 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.861819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.176985Z digest=sha256:79fbed64de17d09b7bd9a4eaa22507e57344e5c5222dca6c8bf3623c5f51935a

Observation 9a7c2ee1-7283-4da4-87a1-57d60ab473c9 · outbound

This paper cites Depeweg, J.-M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J.-M

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.851540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.180214Z digest=sha256:1f5fe5f5caa3edb7b514fb681d7da54f315047c18d9172205910670bd0060101

Observation ac807bce-3985-4452-8c62-ab56b54f2464 · outbound

This paper cites Silver, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Silver, G

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.841236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.183234Z digest=sha256:38c145e3503054242a54af27eed745369fee17496ca2fba5fcafd93134cd80fe

Observation df67475a-3344-44f8-bb1d-40db5796320c · outbound

This paper cites Proximal Policy Optimization Algorithms.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Proximal Policy Optimization Algorithms

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.186542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.186542Z digest=sha256:46596ea822493754c957676fa14ef11067d69e7995b4d4b52437dadfeba03f04

Observation 5e24cdee-19a5-4c68-a66a-bd9fb7088066 · outbound

This paper cites Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.189937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.189937Z digest=sha256:ac4463ec528fde194835f017689397bc4506752f1b86a597d2f5514cb37a03d9

Observation 98e7c06a-8ff2-4ccf-9992-e794d5e71ce5 · outbound

This paper cites Fujimoto, D.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto, D

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.830814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.193715Z digest=sha256:b6fb9baee55fbd0e87fecfe4a63afeb6a6d2a112dbfe9c940137133436cdcac4

Observation fa126106-783f-4b04-8ee2-8e275d229e31 · outbound

This paper cites Kumar, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, J

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.820463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.197040Z digest=sha256:c2c08dd1dc2a5e6fcf96f5087065975753b884fdc774b9d68c720eeb4ae0950f

Observation 364732df-c85a-4534-ac11-1b0ccae7f325 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Behavior Regularized Offline Reinforcement Learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.200672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.200672Z digest=sha256:e03f8d3033bfa45eca87afc9089fc6cef5e069015fd2cb2e2d4683573e6693ad

Observation 039eed4f-f7a5-4231-9493-cdfcac462ff4 · outbound

This paper cites Conservative Q-Learning for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Conservative Q-Learning for Offline Reinforcement Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.204241Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.204241Z digest=sha256:1197ac4cf2836dd420859ef9d21ca13d101addd9eaa3cacba6354eb7d5f581ed

Observation 0d2d64fa-fb64-4cd5-ba0d-8c216076e20b · outbound

This paper cites Fujimoto and S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto and S

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.207800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.207800Z digest=sha256:ffc336573ddb2c88277fceba414ba4ed3ed6f5baadebdb41d97f5bfb2a81ff0c

Observation 042baa0b-1afe-4387-9824-21d356c7369a · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Offline Reinforcement Learning with Implicit Q-Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.211016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.211016Z digest=sha256:64fafed4b5bd7ebd4766cdda3d8877180bc9eeb35fb021865bdc598a4580be52

Observation 5771f901-66f9-4bac-864d-adc6b2ddc2ad · outbound

This paper cites Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.214592Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.214592Z digest=sha256:0083633e9067a88b37c0b82a17a65a6b2e50f1b0f003ebb4f994be2de7dc43a7

Observation f6a2221a-b96b-4b53-9505-2baa3e205f28 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.218162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.218162Z digest=sha256:aa136afd87b92fe11eb04472fa3bffb4a741a615a01ebbd7c434b885e787fe17

Observation 4a8331ce-b95e-4dd6-a96a-fa4c1c42d2a6 · outbound

This paper cites Yin and Y .-X.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Yin and Y .-X

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.798082Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.221550Z digest=sha256:69ea5132e1691f5b0019546ce7a4ef935f2022cd14b41be9401c282be688b367

Observation bfadec26-7551-47a4-b56d-9cee690cb75e · outbound

This paper cites Deisenroth and C.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deisenroth and C

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.788739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.224944Z digest=sha256:f9bb4ad7676d7494470b7de2dfe44f860b95c14d05ab803778336b8e85d1a98e

Observation ca2c9651-c485-4bb7-b59d-ed1bbf24406e · outbound

This paper cites Nagabandi, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Nagabandi, G

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.778647Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.228412Z digest=sha256:fcc50a9511290585f750a9444eab0d9952c050c62ba82408b8a4f24c0a4ed4ba

Observation 24ea62be-82cc-460a-98fc-b8bc5685ccb1 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.767780Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.231693Z digest=sha256:699db47291cc6701a7f03e3275a4e3d8dff0c34b1cb999dbd20c5b47221fb6c5

Observation 1ec8c519-2b1b-4a92-89dd-9ece8c9411a9 · outbound

This paper cites MOReL : Model-Based Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search MOReL : Model-Based Offline Reinforcement Learning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.235096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.235096Z digest=sha256:31c381339a842f0883d69c29379088dd2648d0f5f75105ad64cfc109f321325d

Observation 61afbba5-b495-49d4-ab58-6a28a0c5b91c · outbound

This paper cites PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.238691Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.238691Z digest=sha256:53fa00e47ec9bd60624dc056a708908faeb593da220865c83deb44fa777fc564

Observation b7c4a1c7-8a86-4c82-8f5c-e94faa267464 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.757313Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.242496Z digest=sha256:ae6158d457b406c1c15f314b8a875445e1f8151790ab93968c7787bebd8e8704

Observation 3ef4b400-00fb-4583-ba7b-7558d63419c0 · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.245856Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.245856Z digest=sha256:c1a9734e53ba90baa4f526800fba3b23613755e3018b5a214fbe49c51eba96e6

Observation 607d61f2-ee67-43c5-aa03-574e60dfe407 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.747290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.249654Z digest=sha256:fc64012a2a325668882af892c084e321a57d8ea62c946905ba10a47968f3dc76

Observation 17c4a470-7c82-4479-884e-366bd2d933d2 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.737246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.253191Z digest=sha256:d97fdf2e46222e8194a89c80ba428ae6179813a883571ec8fefebcbf9892a881

Observation 429f1084-f6d0-4519-abd0-6d9203216441 · outbound

This paper cites Schmidhuber.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Schmidhuber

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.726194Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.256829Z digest=sha256:9c85bae1f6ba5d2f31ab3412778317015552fc746e66f43c746c1cd7ecc04514

Observation 1f5571e3-f1a5-4290-abeb-fbca27311ff6 · outbound

This paper cites Pathak, P.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Pathak, P

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.260418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.260418Z digest=sha256:10a7a0de41eac550597545f265cb2bc0f069751eb9cae164485e47649c3b0d65

Observation ad307b53-ffff-48a2-8182-c1c2c22d6a4d · outbound

This paper cites Diversity is All You Need: Learning Skills without a Reward Function.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Diversity is All You Need: Learning Skills without a Reward Function

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.263831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.263831Z digest=sha256:fc8c5dfbe007652241457ea658d94935a8d1942aa714972b6a154e4bb97a0199

Observation d1a872b2-57c7-42f5-acb2-4a179194ab68 · outbound

This paper cites Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.270823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.270823Z digest=sha256:7b5589a1a46505fe8f039c9a6ef618355247b586c9e2f6e0897bc55a8a1cbb84

Observation eb952f6b-4f00-45dd-85b8-f8fecc5cd21a · outbound

This paper cites The Challenges of Exploration for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search The Challenges of Exploration for Offline Reinforcement Learning

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.274317Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.274317Z digest=sha256:4a45dd09afa476a73381f1f0e8736d2cc5b162efd98c389b792483016d383b2f

Observation 3e257135-f4fd-4299-85df-0b174d38135d · outbound

This paper cites Hong, T.-Y.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Hong, T.-Y

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.709563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.277661Z digest=sha256:53d3ea7b61f0d2517888b6b16e487085830596cd02a30b9cea7d130a5770f910

Observation 996d6b90-2aa1-494a-bba9-af38ebd027cd · outbound

This paper cites Parker-Holder, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Parker-Holder, A

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.699525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.281308Z digest=sha256:9315e05eb06f41efa5a3aae9541e240abcd0d23f0b48c18d015d4a310adf38e9

Observation c6ed421f-d888-4541-a690-cd02157dab5a · outbound

This paper cites Kumar, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, A

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.689161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.284743Z digest=sha256:6041d6f9977066bd941ff7e0c92e4427e110dde0502b022a9fa34cd91d32640d

Observation 3aa3e3c5-fd6d-4501-ada2-2695ee97c41d · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.678975Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.287861Z digest=sha256:ea09f26ac1a1bb9355d6779e13e2f5e5a4417d73f5a810052c39da1d8115f0ed

Observation df50044b-3177-4034-8ed4-9913996b9000 · outbound

This paper cites Brandfonbrener, W.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Brandfonbrener, W

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.668919Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.291369Z digest=sha256:bde64c85761a41d46ad9d25d513dc51c994fd03b29bb16e37c02f602897b59b5

Observation 27bf7d8d-8dfa-419c-aa5a-bf48bc422376 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 47

Resolution
metadata mismatch
raw_fallback, observed 2026-08-12T20:47:41.483929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.294798Z digest=sha256:67e7c38e9550510c08300484e4348684d0cfc86b8a262890fa51c26a42e71d9c

Observation 9a460be0-c110-4cb4-88e8-79c250c16adc · outbound

This paper cites Bottou, F.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Bottou, F

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.298099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.298099Z digest=sha256:58e4da4d838dfddae5fcbf2173f92d7bfbc63ee7b34dc01efa140e1ab9824700

Observation 9f9efc1d-5f92-49d8-b88d-b272e3fc6313 · outbound

This paper cites Mangalam, H.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Mangalam, H

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.652288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.301303Z digest=sha256:9df1af2e14e810a85e095268f7b5ca9dc6e2e1084afbfab319bd5ed25295cfdb

Observation d07ac0d6-aba3-4fc5-a912-3b887fd19766 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.304665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.304665Z digest=sha256:0eb6fa1af3a0fb268a21e84bfd1ae18a58b38ba5ab29bb3ed3a096021b71f9bc

Observation 0c68d80d-ed0a-4f0a-aa97-a6ec2709cb0f · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 51

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.636060Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-12T20:47:41.308466Z digest=sha256:f808e65fbee6bbd4099e7659d86422032e5f5c055b9892da65b72afbf04ac302

Pith citing papers

No inbound Pith citation observations are available.