Pith. sign in

Paper Citation Record · LEDGER

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search

As of 14 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2411.09722.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.09722 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T20:47:41.308466Z

measured 50 of 50 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

50 of 50 outbound references displayed

  • verified exact1
  • verified fuzzy21
  • unresolved27
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation baea27a8-b8a8-4b29-a92b-0d9ed4d63090 · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.962900Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.133523Z digest=sha256:4822c182f3eec41fbaf9b8336bba09527746d01c72f871bd78b1d64723ce4655

Observation c0b5c7d2-f0bb-4677-8a32-6d99c98dd0a8 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.953391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.138522Z digest=sha256:e5c02a4388b5e132aa0f647b1c63f21bd49b21430a5b8eced29d52ab4a6fbb2d

Observation 38a072be-3f9d-4f8c-b0f0-14065cc9b6d7 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.943477Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.142320Z digest=sha256:3178efe347d4ab07fb02d2ff426a3e6095d8771f922d164ee4082b1f69fc3968

Observation 2c2c3844-7be9-45cc-b185-156081afaa58 · outbound

This paper cites Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.146371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.146371Z digest=sha256:fa3ed37402d13f9d5112bb686ffed5305daeedf6b5c6cd4b34807c7ae6c2f897

Observation f4dcf8f0-80de-487b-92f0-17e0e961f924 · outbound

This paper cites Iteratively Refined Behavior Regularization for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Iteratively Refined Behavior Regularization for Offline Reinforcement Learning

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-08-12T20:47:41.614831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.150335Z digest=sha256:a0412b2d320c2c591d23debcfe52e95ad2adf4992075930431db1e882c5151da

Observation 55695fe5-8b1b-4a25-b3d0-7feede4eeede · outbound

This paper cites Zhang, L.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Zhang, L

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.933634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.154072Z digest=sha256:2016d8936e4648fb91e4b9d97ae772ea20d4c7f176fe805cdfec933c38d6692b

Observation 88ed4f6e-9224-4677-adea-e8c74999192a · outbound

This paper cites Ernst, M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Ernst, M

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.923767Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.157701Z digest=sha256:9be4f5fc9075fc487de192f9161f9a07dff0d73765af9b2a1bf89abff54e8f87

Observation 68c30bc7-28cd-44fa-b7ff-bbc6d7211145 · outbound

This paper cites Riedmiller.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.913203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.160746Z digest=sha256:2f0c17c5a2a2cebabb4c962f9f220b77e79e94706b33a6647ad2cee7decdd4b9

Observation d42e0400-740e-4db2-b6bd-78b866b1a99a · outbound

This paper cites Riedmiller, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller, T

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.903072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.164027Z digest=sha256:8f8fbf2345dbae2555e661fc90ed499ed60951ac4604b47688887bda2efc7a42

Observation ebb67969-2615-4c9d-9222-1b6d86edbf8b · outbound

This paper cites Lange, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Lange, T

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.893147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.167320Z digest=sha256:de8034a3fa266780dcd841084d0d55126a68190ee0b18b41343171ca53fe959f

Observation e1c42eff-c223-4ec1-a0f2-a158b5f0e0b3 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.883029Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.170526Z digest=sha256:3db8e58a44061d36957660f2048a29c09cf8308199dbe8f94caf3cdd2081aebd

Observation 19d16d6d-bcae-4f81-b986-7ca422082b74 · outbound

This paper cites Depeweg, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.872665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.173724Z digest=sha256:9dada929a90fb1ad833a05199949d29ae7fcad64609d6173ea92a667cd522ff3

Observation f159b5a8-a407-464a-bbe5-2aa31e6b6c08 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.861819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.176985Z digest=sha256:91139856b527044046436d76bf24e979a2d107e6d28197095b203a57035b563d

Observation 9a7c2ee1-7283-4da4-87a1-57d60ab473c9 · outbound

This paper cites Depeweg, J.-M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J.-M

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.851540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.180214Z digest=sha256:cffbb9e73713bbce55b5365adbb4965a9830d3761a6799542318c722a5b79d7c

Observation ac807bce-3985-4452-8c62-ab56b54f2464 · outbound

This paper cites Silver, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Silver, G

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.841236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.183234Z digest=sha256:f3521e5110cea0b72767b52751913cd9b301d66c98a24a00c25da1d1451ecc2e

Observation df67475a-3344-44f8-bb1d-40db5796320c · outbound

This paper cites Proximal Policy Optimization Algorithms.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Proximal Policy Optimization Algorithms

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.186542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.186542Z digest=sha256:078ee4df4c926d02ea1fc1bce18dffdd0f96321f2bb946e7bd712ae14be785df

Observation 5e24cdee-19a5-4c68-a66a-bd9fb7088066 · outbound

This paper cites Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.189937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.189937Z digest=sha256:591f300ab1a996ff5993309a9e605df03bc935ada7f31e7424d7d531d6ec8e9b

Observation 98e7c06a-8ff2-4ccf-9992-e794d5e71ce5 · outbound

This paper cites Fujimoto, D.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto, D

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.830814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.193715Z digest=sha256:e386e7d82adf498ec711d01e3099608c6475ff15219e09bf20733eaa7b461bd7

Observation fa126106-783f-4b04-8ee2-8e275d229e31 · outbound

This paper cites Kumar, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, J

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.820463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.197040Z digest=sha256:8301e7a77cd23871b8d3fc340018df25d1dd3e73d2bcef90dff3a6473866e50d

Observation 364732df-c85a-4534-ac11-1b0ccae7f325 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Behavior Regularized Offline Reinforcement Learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.200672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.200672Z digest=sha256:a69d73a898a1445090990247b63bba7eedd57756b6b5c1425bb5e9c7e9ee34be

Observation 039eed4f-f7a5-4231-9493-cdfcac462ff4 · outbound

This paper cites Conservative Q-Learning for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Conservative Q-Learning for Offline Reinforcement Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.204241Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.204241Z digest=sha256:a9cddb5b9c0661759084f2cba53b9cef89c653494bc3db5e97d5ede6ce998da1

Observation 0d2d64fa-fb64-4cd5-ba0d-8c216076e20b · outbound

This paper cites Fujimoto and S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto and S

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.207800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.207800Z digest=sha256:ca954074cb7ac370a69a6bdea0b5be5f2592e1dae7373e698ae89c356470286f

Observation 042baa0b-1afe-4387-9824-21d356c7369a · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Offline Reinforcement Learning with Implicit Q-Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.211016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.211016Z digest=sha256:1e8974b887089134d54c892ee4bd8f3e0189089591517df4f213dab07a4337ec

Observation 5771f901-66f9-4bac-864d-adc6b2ddc2ad · outbound

This paper cites Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.214592Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.214592Z digest=sha256:93a1ed06ec59b13f0a0e800d350bf10802d047b1f76e93b8ca59d893a0788fc8

Observation f6a2221a-b96b-4b53-9505-2baa3e205f28 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.218162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.218162Z digest=sha256:0bd1c073a0a200a2bdd944401a9c116a8c01653b6ae46944d72a9df8e4cc6868

Observation 4a8331ce-b95e-4dd6-a96a-fa4c1c42d2a6 · outbound

This paper cites Yin and Y .-X.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Yin and Y .-X

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.798082Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.221550Z digest=sha256:d71a0bea0bad78ac05493a369522eacdd6307a4a76db3ca5694bea16577ebd67

Observation bfadec26-7551-47a4-b56d-9cee690cb75e · outbound

This paper cites Deisenroth and C.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deisenroth and C

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.788739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.224944Z digest=sha256:9ec433d7f14dd3114ee93af7ba8f1b24e321e997a61d69059598e33c1cb5dfb4

Observation ca2c9651-c485-4bb7-b59d-ed1bbf24406e · outbound

This paper cites Nagabandi, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Nagabandi, G

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.778647Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.228412Z digest=sha256:530d5bab044fba48ca328cd73407a255f0ee1d68d6cfe58869cf4d68da59dca4

Observation 24ea62be-82cc-460a-98fc-b8bc5685ccb1 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.767780Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.231693Z digest=sha256:12c17b30b6fd17b4b0e15b1ff27624eb61693672db3ec574a60f5cd1a1e11b27

Observation 1ec8c519-2b1b-4a92-89dd-9ece8c9411a9 · outbound

This paper cites MOReL : Model-Based Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search MOReL : Model-Based Offline Reinforcement Learning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.235096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.235096Z digest=sha256:bb0633110057bcb73b272d9a3d98813abe6d752524bb4f7eca652a3f4c380ce7

Observation 61afbba5-b495-49d4-ab58-6a28a0c5b91c · outbound

This paper cites PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.238691Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.238691Z digest=sha256:3f57ea8074f5e45d381825bd674ff66aedea6efdb44162bfeab352fd5d6d0dab

Observation b7c4a1c7-8a86-4c82-8f5c-e94faa267464 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.757313Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.242496Z digest=sha256:69c3c2acc9fb608e015fa39df2fa196a4625a945ca097b2fb47ab8e83ff9e5fe

Observation 3ef4b400-00fb-4583-ba7b-7558d63419c0 · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.245856Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.245856Z digest=sha256:bbfa75d61ebe484868779f8fc6925dcc6bb9d099ec17a6b0c1c2ac474cab3b74

Observation 607d61f2-ee67-43c5-aa03-574e60dfe407 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.747290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.249654Z digest=sha256:763aa82447a4d1fffa2b5ee6ec67ab2bb79e6d0c9d4d5188f3e6dd6be28ebec4

Observation 17c4a470-7c82-4479-884e-366bd2d933d2 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.737246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.253191Z digest=sha256:e1c85d28f75fc88f16d635dcb4a84579ccedfbde27fd463c02348040ec01004f

Observation 429f1084-f6d0-4519-abd0-6d9203216441 · outbound

This paper cites Schmidhuber.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Schmidhuber

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.726194Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.256829Z digest=sha256:b0d61533856899473dfe5d9d4684e643a38f723da3b1938de579276f35124adb

Observation 1f5571e3-f1a5-4290-abeb-fbca27311ff6 · outbound

This paper cites Pathak, P.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Pathak, P

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.260418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.260418Z digest=sha256:f8b8bfcf898b37fd4cef73f4c86b2bc5776f267461a84ee0f0e43ee8a893a3dd

Observation ad307b53-ffff-48a2-8182-c1c2c22d6a4d · outbound

This paper cites Diversity is All You Need: Learning Skills without a Reward Function.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Diversity is All You Need: Learning Skills without a Reward Function

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.263831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.263831Z digest=sha256:0eea1d28e2761d7019a21767d82df3defe9fab31150337944899046426382d3d

Observation d1a872b2-57c7-42f5-acb2-4a179194ab68 · outbound

This paper cites Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.270823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.270823Z digest=sha256:529fe74988af0e3b11cf98dd8dc79d84deabad785eb33b9e675c620136a853c0

Observation eb952f6b-4f00-45dd-85b8-f8fecc5cd21a · outbound

This paper cites The Challenges of Exploration for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search The Challenges of Exploration for Offline Reinforcement Learning

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.274317Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.274317Z digest=sha256:d517774fd549bb975e357dd3b5cdea2453ef0bd4cb5b25063bfc31e8c797f724

Observation 3e257135-f4fd-4299-85df-0b174d38135d · outbound

This paper cites Hong, T.-Y.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Hong, T.-Y

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.709563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.277661Z digest=sha256:b265e7c8b59d1f358a5f7bc14bf152175dfade0e1c630d9a1b954b24a1c68562

Observation 996d6b90-2aa1-494a-bba9-af38ebd027cd · outbound

This paper cites Parker-Holder, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Parker-Holder, A

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.699525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.281308Z digest=sha256:d7b29aa6c2926bf22733d76d717659d761c2f50ff8b56bd96b719a3d5e9e7628

Observation c6ed421f-d888-4541-a690-cd02157dab5a · outbound

This paper cites Kumar, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, A

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.689161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.284743Z digest=sha256:a6287e7483a4bbc764427a211eac085219b7aaeb56f6ca37c3794f3b190fac3a

Observation 3aa3e3c5-fd6d-4501-ada2-2695ee97c41d · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.678975Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.287861Z digest=sha256:a6db9d879b3ea2b6ccb4904a8ce459200ebc90f020de514e1afee357e09ab254

Observation df50044b-3177-4034-8ed4-9913996b9000 · outbound

This paper cites Brandfonbrener, W.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Brandfonbrener, W

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.668919Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.291369Z digest=sha256:9ddade3d5e5d5fe5903501fdff1924e002b89d5587df20cd292f93911caf5d8c

Observation 27bf7d8d-8dfa-419c-aa5a-bf48bc422376 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 47

Resolution
metadata mismatch
raw_fallback, observed 2026-08-12T20:47:41.483929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.294798Z digest=sha256:4eef4aa0abe2c247c4dc3113d0f749eef2c48e1a389ba290fb981c816fb1e374

Observation 9a460be0-c110-4cb4-88e8-79c250c16adc · outbound

This paper cites Bottou, F.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Bottou, F

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.298099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.298099Z digest=sha256:cbd2f374e43c1ecc2bf758d1c9e68cccdbc38712a09f0d2205b4422df6454466

Observation 9f9efc1d-5f92-49d8-b88d-b272e3fc6313 · outbound

This paper cites Mangalam, H.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Mangalam, H

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.652288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.301303Z digest=sha256:5cff12144a01d9a95ec67565e02ceffe5114fe5ee175a3f54dddd9ec5f097700

Observation d07ac0d6-aba3-4fc5-a912-3b887fd19766 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.304665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.304665Z digest=sha256:0ace0199dff75ed976aa486e08b81d221485a23b3aeedaa687998be0bfbad787

Observation 0c68d80d-ed0a-4f0a-aa97-a6ec2709cb0f · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 51

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.636060Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.308466Z digest=sha256:83b466d9b118e80450e00e451401d7f54024baf26d58d845d5a4bc60d5350dbb

Pith citing papers

No inbound Pith citation observations are available.