Pith. sign in

Paper Citation Record · LEDGER

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search

As of 20 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2411.09722.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.09722 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T20:47:41.308466Z

measured 50 of 50 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

50 of 50 outbound references displayed

  • verified exact1
  • verified fuzzy21
  • unresolved27
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation baea27a8-b8a8-4b29-a92b-0d9ed4d63090 · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.962900Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.133523Z digest=sha256:b7633a8ac029022041f5b25ddc37570a1a2fbe289c6ee4ffef7626d23c6375cd

Observation c0b5c7d2-f0bb-4677-8a32-6d99c98dd0a8 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.953391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.138522Z digest=sha256:235377c0209d7a25a5d0a622dbc5d20e92ecf4c822e98167d5f06a95a67b627f

Observation 38a072be-3f9d-4f8c-b0f0-14065cc9b6d7 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.943477Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.142320Z digest=sha256:2ebfe4a5d8eb159c0176f80c4c9c3720a0f88a806eba78ce3a81b086e2dfc786

Observation 2c2c3844-7be9-45cc-b185-156081afaa58 · outbound

This paper cites Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.146371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.146371Z digest=sha256:cca5e2988791295df6d6e8407cd08543cd9654afc0a64d1854d95d471097f146

Observation f4dcf8f0-80de-487b-92f0-17e0e961f924 · outbound

This paper cites Iteratively Refined Behavior Regularization for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Iteratively Refined Behavior Regularization for Offline Reinforcement Learning

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-08-12T20:47:41.614831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.150335Z digest=sha256:cc8b7646d8a607e06d3962abc09202922dfb3c9ec767956d71757d88756f163e

Observation 55695fe5-8b1b-4a25-b3d0-7feede4eeede · outbound

This paper cites Zhang, L.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Zhang, L

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.933634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.154072Z digest=sha256:fb29b4141f0dc3ea0c90b064e57d0069a14689d520759662a581d110bd5787df

Observation 88ed4f6e-9224-4677-adea-e8c74999192a · outbound

This paper cites Ernst, M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Ernst, M

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.923767Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.157701Z digest=sha256:952da3a64138b05f8ecf47ed37e504b6f0695d36bb159447805478e0e4ec6704

Observation 68c30bc7-28cd-44fa-b7ff-bbc6d7211145 · outbound

This paper cites Riedmiller.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.913203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.160746Z digest=sha256:d8983aec5f0ff363d41e03312376c96b0dab29fa2b800cc1befcf42af5ceeeb3

Observation d42e0400-740e-4db2-b6bd-78b866b1a99a · outbound

This paper cites Riedmiller, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller, T

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.903072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.164027Z digest=sha256:c9269bdbfccd5ac1ff412edb06323cc2fbe0d9e0bc9288cc563d73d12b0a97ba

Observation ebb67969-2615-4c9d-9222-1b6d86edbf8b · outbound

This paper cites Lange, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Lange, T

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.893147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.167320Z digest=sha256:b0b82f633a80aeb588e76b6ea088055dc1a7a8849d552a79aa2cee19e02b7b4f

Observation e1c42eff-c223-4ec1-a0f2-a158b5f0e0b3 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.883029Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.170526Z digest=sha256:a9a368934a057dbc6dd0b0bf1c36bda6c234cc4e74457dfbe344950a9272ff86

Observation 19d16d6d-bcae-4f81-b986-7ca422082b74 · outbound

This paper cites Depeweg, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.872665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.173724Z digest=sha256:fc1475f5b5c8fbd893a4ddcccd2586d601f36d7541f4b3ec0141b53cba9b546e

Observation f159b5a8-a407-464a-bbe5-2aa31e6b6c08 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.861819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.176985Z digest=sha256:43bcb25753695e4d2ce779a6253a0d182aff556e62ef8e1202f9177643286ba5

Observation 9a7c2ee1-7283-4da4-87a1-57d60ab473c9 · outbound

This paper cites Depeweg, J.-M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J.-M

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.851540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.180214Z digest=sha256:6c6ada6c3fc4f8e0040adc7b173312a4cdc0b4d3d07730a7ffa6fb4aafca714d

Observation ac807bce-3985-4452-8c62-ab56b54f2464 · outbound

This paper cites Silver, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Silver, G

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.841236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.183234Z digest=sha256:390ad33fba223476463af5fb47f8942a92b4e905b0a2e9614b93e273dfe86ccc

Observation df67475a-3344-44f8-bb1d-40db5796320c · outbound

This paper cites Proximal Policy Optimization Algorithms.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Proximal Policy Optimization Algorithms

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.186542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.186542Z digest=sha256:bb7223523d2af89d2bf45f7f5a5b02adabfb3814d291549db9a06c0dd611d229

Observation 5e24cdee-19a5-4c68-a66a-bd9fb7088066 · outbound

This paper cites Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.189937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.189937Z digest=sha256:ac4463ec528fde194835f017689397bc4506752f1b86a597d2f5514cb37a03d9

Observation 98e7c06a-8ff2-4ccf-9992-e794d5e71ce5 · outbound

This paper cites Fujimoto, D.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto, D

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.830814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.193715Z digest=sha256:cf62ca0216e671a6a59b40add53892cc11cb19ecaa85ebd92f59ec430a0999cd

Observation fa126106-783f-4b04-8ee2-8e275d229e31 · outbound

This paper cites Kumar, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, J

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.820463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.197040Z digest=sha256:1e023e86d2bc037c56430b3659dc64abda9e275616a32f75bbe2e8d51b7814f7

Observation 364732df-c85a-4534-ac11-1b0ccae7f325 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Behavior Regularized Offline Reinforcement Learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.200672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.200672Z digest=sha256:e03f8d3033bfa45eca87afc9089fc6cef5e069015fd2cb2e2d4683573e6693ad

Observation 039eed4f-f7a5-4231-9493-cdfcac462ff4 · outbound

This paper cites Conservative Q-Learning for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Conservative Q-Learning for Offline Reinforcement Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.204241Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.204241Z digest=sha256:1197ac4cf2836dd420859ef9d21ca13d101addd9eaa3cacba6354eb7d5f581ed

Observation 0d2d64fa-fb64-4cd5-ba0d-8c216076e20b · outbound

This paper cites Fujimoto and S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto and S

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.207800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.207800Z digest=sha256:ffc336573ddb2c88277fceba414ba4ed3ed6f5baadebdb41d97f5bfb2a81ff0c

Observation 042baa0b-1afe-4387-9824-21d356c7369a · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Offline Reinforcement Learning with Implicit Q-Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.211016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.211016Z digest=sha256:64fafed4b5bd7ebd4766cdda3d8877180bc9eeb35fb021865bdc598a4580be52

Observation 5771f901-66f9-4bac-864d-adc6b2ddc2ad · outbound

This paper cites Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.214592Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.214592Z digest=sha256:0083633e9067a88b37c0b82a17a65a6b2e50f1b0f003ebb4f994be2de7dc43a7

Observation f6a2221a-b96b-4b53-9505-2baa3e205f28 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.218162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.218162Z digest=sha256:aa136afd87b92fe11eb04472fa3bffb4a741a615a01ebbd7c434b885e787fe17

Observation 4a8331ce-b95e-4dd6-a96a-fa4c1c42d2a6 · outbound

This paper cites Yin and Y .-X.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Yin and Y .-X

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.798082Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.221550Z digest=sha256:ece8798a555a88d007865900edd52785e5cfc9e6e4261d63fd4c5ee0257c1003

Observation bfadec26-7551-47a4-b56d-9cee690cb75e · outbound

This paper cites Deisenroth and C.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deisenroth and C

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.788739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.224944Z digest=sha256:ee434515a0d4ed9ab2e97a1760d2a0ad2ad9e4b51f97d8b34c822d7c47bd970b

Observation ca2c9651-c485-4bb7-b59d-ed1bbf24406e · outbound

This paper cites Nagabandi, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Nagabandi, G

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.778647Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.228412Z digest=sha256:858a8a37a87326913dd675ccac90ce9aa2f853338f3f1c66d010429eab36dafc

Observation 24ea62be-82cc-460a-98fc-b8bc5685ccb1 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.767780Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.231693Z digest=sha256:d36ae85e0dd2b6f9bdfd7936e43443d7b949d3d3dc1cfe54f4c303b431b13819

Observation 1ec8c519-2b1b-4a92-89dd-9ece8c9411a9 · outbound

This paper cites MOReL : Model-Based Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search MOReL : Model-Based Offline Reinforcement Learning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.235096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.235096Z digest=sha256:31c381339a842f0883d69c29379088dd2648d0f5f75105ad64cfc109f321325d

Observation 61afbba5-b495-49d4-ab58-6a28a0c5b91c · outbound

This paper cites PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.238691Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.238691Z digest=sha256:53fa00e47ec9bd60624dc056a708908faeb593da220865c83deb44fa777fc564

Observation b7c4a1c7-8a86-4c82-8f5c-e94faa267464 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.757313Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.242496Z digest=sha256:bd51ae8424d6b6a91f1f314fb7a57a80b24a75e3a1a5a824437f16cb578abc1d

Observation 3ef4b400-00fb-4583-ba7b-7558d63419c0 · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.245856Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.245856Z digest=sha256:c1a9734e53ba90baa4f526800fba3b23613755e3018b5a214fbe49c51eba96e6

Observation 607d61f2-ee67-43c5-aa03-574e60dfe407 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.747290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.249654Z digest=sha256:85a0bd1229b1499abdef06e951d123a1af7755594f69ff9fe16d35dc3cdd4eeb

Observation 17c4a470-7c82-4479-884e-366bd2d933d2 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.737246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.253191Z digest=sha256:99f31dee7ac07a29ea2f85c59bf7e48ad4d8954abbb52b68d6bc330e9a4ca380

Observation 429f1084-f6d0-4519-abd0-6d9203216441 · outbound

This paper cites Schmidhuber.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Schmidhuber

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.726194Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.256829Z digest=sha256:ae8280219500bfad4d2dc4c1c8b8e7d4362bdfb9505f4bd1b4dc56453e8f9eef

Observation 1f5571e3-f1a5-4290-abeb-fbca27311ff6 · outbound

This paper cites Pathak, P.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Pathak, P

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.260418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.260418Z digest=sha256:10a7a0de41eac550597545f265cb2bc0f069751eb9cae164485e47649c3b0d65

Observation ad307b53-ffff-48a2-8182-c1c2c22d6a4d · outbound

This paper cites Diversity is All You Need: Learning Skills without a Reward Function.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Diversity is All You Need: Learning Skills without a Reward Function

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.263831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.263831Z digest=sha256:fc8c5dfbe007652241457ea658d94935a8d1942aa714972b6a154e4bb97a0199

Observation d1a872b2-57c7-42f5-acb2-4a179194ab68 · outbound

This paper cites Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.270823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.270823Z digest=sha256:7b5589a1a46505fe8f039c9a6ef618355247b586c9e2f6e0897bc55a8a1cbb84

Observation eb952f6b-4f00-45dd-85b8-f8fecc5cd21a · outbound

This paper cites The Challenges of Exploration for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search The Challenges of Exploration for Offline Reinforcement Learning

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.274317Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.274317Z digest=sha256:4a45dd09afa476a73381f1f0e8736d2cc5b162efd98c389b792483016d383b2f

Observation 3e257135-f4fd-4299-85df-0b174d38135d · outbound

This paper cites Hong, T.-Y.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Hong, T.-Y

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.709563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.277661Z digest=sha256:817febb6ecf6112e06a7156b9a8691163020c00a12e7bc034e732893b7afe33a

Observation 996d6b90-2aa1-494a-bba9-af38ebd027cd · outbound

This paper cites Parker-Holder, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Parker-Holder, A

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.699525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.281308Z digest=sha256:51e8f18ff13f7345d6fea3e212c7387c493f23ec303a5cb8b8e858cd74cc8128

Observation c6ed421f-d888-4541-a690-cd02157dab5a · outbound

This paper cites Kumar, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, A

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.689161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.284743Z digest=sha256:fb056f43ad881e3b073c8bac0c7c1748536e0571785a718dffd1f46633ab90f1

Observation 3aa3e3c5-fd6d-4501-ada2-2695ee97c41d · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.678975Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.287861Z digest=sha256:68d4c5f560387d8296e3d3ae2313d572a813e40061deee3dcf295e5837c28fad

Observation df50044b-3177-4034-8ed4-9913996b9000 · outbound

This paper cites Brandfonbrener, W.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Brandfonbrener, W

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.668919Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.291369Z digest=sha256:27ab465a213bf5d2f337f9d732a3068488650e85bb7face452c841235f70ad70

Observation 27bf7d8d-8dfa-419c-aa5a-bf48bc422376 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 47

Resolution
metadata mismatch
raw_fallback, observed 2026-08-12T20:47:41.483929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.294798Z digest=sha256:5aee33b613ad9e2335351eb8164435921f985c8d0e88363bc4bc6b8389089286

Observation 9a460be0-c110-4cb4-88e8-79c250c16adc · outbound

This paper cites Bottou, F.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Bottou, F

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.298099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.298099Z digest=sha256:58e4da4d838dfddae5fcbf2173f92d7bfbc63ee7b34dc01efa140e1ab9824700

Observation 9f9efc1d-5f92-49d8-b88d-b272e3fc6313 · outbound

This paper cites Mangalam, H.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Mangalam, H

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.652288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.301303Z digest=sha256:f6812c46c9b30f585719e0503a5eed3cad14d389e81c04924d20f8b6a3cc07af

Observation d07ac0d6-aba3-4fc5-a912-3b887fd19766 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.304665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.304665Z digest=sha256:0eb6fa1af3a0fb268a21e84bfd1ae18a58b38ba5ab29bb3ed3a096021b71f9bc

Observation 0c68d80d-ed0a-4f0a-aa97-a6ec2709cb0f · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 51

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.636060Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T20:47:41.308466Z digest=sha256:d19b877ea0e0552982457389e45c2044f212177f21c1f3b8021aa60a44610dc4

Pith citing papers

No inbound Pith citation observations are available.