Pith. sign in

Paper Citation Record · LEDGER

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search

As of 14 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2411.09722.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.09722 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T20:47:41.308466Z

measured 50 of 50 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

50 of 50 outbound references displayed

  • verified exact1
  • verified fuzzy21
  • unresolved27
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation baea27a8-b8a8-4b29-a92b-0d9ed4d63090 · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.962900Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.133523Z digest=sha256:79206a868912cf90fb6c77e2a6561c8c9f6f3e5ac731860c2366258de69d84ae

Observation c0b5c7d2-f0bb-4677-8a32-6d99c98dd0a8 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.953391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.138522Z digest=sha256:63dd91ee0012d9d92d5f8da42b9dc0e4f59078061ed9a6fb334e402d8376a00c

Observation 38a072be-3f9d-4f8c-b0f0-14065cc9b6d7 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.943477Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.142320Z digest=sha256:2d6f9c0be382504d458bdb1be3ad05757d7df0a6782dc1ba32103f75e05b4629

Observation 2c2c3844-7be9-45cc-b185-156081afaa58 · outbound

This paper cites Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.146371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.146371Z digest=sha256:cc3d272ff567193f0c4c3bc914c588e57ef88b4dabb790510dbf8a695ba5b147

Observation f4dcf8f0-80de-487b-92f0-17e0e961f924 · outbound

This paper cites Iteratively Refined Behavior Regularization for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Iteratively Refined Behavior Regularization for Offline Reinforcement Learning

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-08-12T20:47:41.614831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.150335Z digest=sha256:eade72fe23bc7e255810d48aa42326c9f422ff8084bee2749cdfc207f54d1371

Observation 55695fe5-8b1b-4a25-b3d0-7feede4eeede · outbound

This paper cites Zhang, L.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Zhang, L

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.933634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.154072Z digest=sha256:bb3274d7cb36ff866c1062b8a46d8a4628dce6ad4fb00d6eee37b4bb001bbd7d

Observation 88ed4f6e-9224-4677-adea-e8c74999192a · outbound

This paper cites Ernst, M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Ernst, M

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.923767Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.157701Z digest=sha256:84e7223b007a0d9bbd85abaafa29b97995ef8e2147e3d51094e071c5c2846d07

Observation 68c30bc7-28cd-44fa-b7ff-bbc6d7211145 · outbound

This paper cites Riedmiller.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.913203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.160746Z digest=sha256:8213a2b864dca403d5f3059491e9bd8128714ee1c053a61dff76f86a3326c884

Observation d42e0400-740e-4db2-b6bd-78b866b1a99a · outbound

This paper cites Riedmiller, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Riedmiller, T

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.903072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.164027Z digest=sha256:d73f1eead03437eb5fe75b5d0666ad6ff813e9e10af54cb618340f691be9141e

Observation ebb67969-2615-4c9d-9222-1b6d86edbf8b · outbound

This paper cites Lange, T.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Lange, T

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.893147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.167320Z digest=sha256:5aa6c3e3619c52d069d2ec2144fe8c05755a1d74f0b85a6dba5c90f167d0b7ac

Observation e1c42eff-c223-4ec1-a0f2-a158b5f0e0b3 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.883029Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.170526Z digest=sha256:c437e6b6ef00d21269c3bd9294a93eb8dc81d45fa78a886b5ad41a683a18ad9f

Observation 19d16d6d-bcae-4f81-b986-7ca422082b74 · outbound

This paper cites Depeweg, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.872665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.173724Z digest=sha256:181dcf0b2955e7b1d87666fce417b891679eaadadb79477bc08b22507c359140

Observation f159b5a8-a407-464a-bbe5-2aa31e6b6c08 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.861819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.176985Z digest=sha256:8756843badab580d1afd39611731c218f864225861d99b71093d78c90f9e1f22

Observation 9a7c2ee1-7283-4da4-87a1-57d60ab473c9 · outbound

This paper cites Depeweg, J.-M.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Depeweg, J.-M

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.851540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.180214Z digest=sha256:83d283e8aa55a46829aa499ce087b5898066e99381b3cfe3bcc5fc0cb41ae87a

Observation ac807bce-3985-4452-8c62-ab56b54f2464 · outbound

This paper cites Silver, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Silver, G

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.841236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.183234Z digest=sha256:6bd196148b6b9676865e1fdd76c64b7fd02fc5f86a5e099bf85dcc62616cd542

Observation df67475a-3344-44f8-bb1d-40db5796320c · outbound

This paper cites Proximal Policy Optimization Algorithms.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Proximal Policy Optimization Algorithms

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.186542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.186542Z digest=sha256:de29dedade8127cc4f0c5715d325cb2a11856801dfb7bd0dcc4f6debd1bce012

Observation 5e24cdee-19a5-4c68-a66a-bd9fb7088066 · outbound

This paper cites Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.189937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.189937Z digest=sha256:37171f260bf91cb68497ea96a29826cd7ac2c2d5fb4f2210cc0f35be5f053f16

Observation 98e7c06a-8ff2-4ccf-9992-e794d5e71ce5 · outbound

This paper cites Fujimoto, D.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto, D

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.830814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.193715Z digest=sha256:24e68bbeea404578f122192a451c2127ff0ed75f51831ba7dd48c04820fa602d

Observation fa126106-783f-4b04-8ee2-8e275d229e31 · outbound

This paper cites Kumar, J.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, J

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.820463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.197040Z digest=sha256:e972245d1f7ec001d240e1491f6d24d3ec910b11ea1850f6757c044db0f412ef

Observation 364732df-c85a-4534-ac11-1b0ccae7f325 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Behavior Regularized Offline Reinforcement Learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.200672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.200672Z digest=sha256:c3c86aab19e220d3cca7f8f0e37214073d65a8e1314a179ab19513349fedd8e3

Observation 039eed4f-f7a5-4231-9493-cdfcac462ff4 · outbound

This paper cites Conservative Q-Learning for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Conservative Q-Learning for Offline Reinforcement Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.204241Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.204241Z digest=sha256:709b40e6d54ece9244d8e4fd8b975670fc83a6592d84ff4d49e1a7b8934f7b2d

Observation 0d2d64fa-fb64-4cd5-ba0d-8c216076e20b · outbound

This paper cites Fujimoto and S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Fujimoto and S

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.207800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.207800Z digest=sha256:dc62c5457688ae045553ca9de33df3df6fbcf99ecc78c1d5009358a5b1e67c6e

Observation 042baa0b-1afe-4387-9824-21d356c7369a · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Offline Reinforcement Learning with Implicit Q-Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.211016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.211016Z digest=sha256:acabe0aaa8edf70b7f8d7445a7ad6a1fecdf24217b8cf5f58c9104dfa96276a6

Observation 5771f901-66f9-4bac-864d-adc6b2ddc2ad · outbound

This paper cites Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.214592Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.214592Z digest=sha256:acc7144cc2c8f32195da4834d55aeea005ae1ec3a7f4d905a4a4059fb436d38b

Observation f6a2221a-b96b-4b53-9505-2baa3e205f28 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.218162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.218162Z digest=sha256:5ec3c98a5b2c71d2e174288d961a5152148bc7b877d2b70650f88a79b4fb17b8

Observation 4a8331ce-b95e-4dd6-a96a-fa4c1c42d2a6 · outbound

This paper cites Yin and Y .-X.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Yin and Y .-X

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.798082Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.221550Z digest=sha256:4cfade70b753258ab4348baa9bde5a4f46280e299f308805c0c94bc3b7acd081

Observation bfadec26-7551-47a4-b56d-9cee690cb75e · outbound

This paper cites Deisenroth and C.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Deisenroth and C

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.788739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.224944Z digest=sha256:c218567253badcc0fb08c2b5ba87bfdb42a780b80bd9e67d6ce2cf357f3ac301

Observation ca2c9651-c485-4bb7-b59d-ed1bbf24406e · outbound

This paper cites Nagabandi, G.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Nagabandi, G

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.778647Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.228412Z digest=sha256:a25d85eb6000f144bf69097e7a6502dd8f2e6d1f46a6dd175d9af50a3c5e7e20

Observation 24ea62be-82cc-460a-98fc-b8bc5685ccb1 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.767780Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.231693Z digest=sha256:2d9fd2d399881a138a60006121aabedc73d9bfc0221a6988908437feda8f0617

Observation 1ec8c519-2b1b-4a92-89dd-9ece8c9411a9 · outbound

This paper cites MOReL : Model-Based Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search MOReL : Model-Based Offline Reinforcement Learning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.235096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.235096Z digest=sha256:fc1bcd18cd4df05ca14d8059977ab1eec8c33c661d45a363b8adb1d44bd8f717

Observation 61afbba5-b495-49d4-ab58-6a28a0c5b91c · outbound

This paper cites PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search PROTO: Iterative Policy Regularized Offline-to-Online Reinforcement Learning

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.238691Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.238691Z digest=sha256:dc66cbfa0167e43607e01bd27bbd880962d34085696eefa6368465a4eff422ff

Observation b7c4a1c7-8a86-4c82-8f5c-e94faa267464 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.757313Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.242496Z digest=sha256:0445ce07152612c7b77de30189afbdf266ebc4cbabf019bb8d89fc5ca59c850f

Observation 3ef4b400-00fb-4583-ba7b-7558d63419c0 · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.245856Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.245856Z digest=sha256:7719cd8d7a17f2ff9a02781af215eb98a0e1b991ee2e74cb28ebd00212ac0d08

Observation 607d61f2-ee67-43c5-aa03-574e60dfe407 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.747290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.249654Z digest=sha256:ffa16bc0ed1b050a11cd75f23e7d25e9fc22aa537b2ff73235ae76690ebe8b91

Observation 17c4a470-7c82-4479-884e-366bd2d933d2 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.737246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.253191Z digest=sha256:60c47b892b85e762639f726b01737e6956ff07a651bec68b52f2f966c20d7dd6

Observation 429f1084-f6d0-4519-abd0-6d9203216441 · outbound

This paper cites Schmidhuber.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Schmidhuber

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.726194Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.256829Z digest=sha256:9ff40e6c4ccb0eec6d5894a038ca1187a437261006eb323375096c35fdff3b2f

Observation 1f5571e3-f1a5-4290-abeb-fbca27311ff6 · outbound

This paper cites Pathak, P.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Pathak, P

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.260418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.260418Z digest=sha256:9dcb645cab88bef3f22c0bd531cfc44d4c4b7767b27f9f141fed50907d0b8550

Observation ad307b53-ffff-48a2-8182-c1c2c22d6a4d · outbound

This paper cites Diversity is All You Need: Learning Skills without a Reward Function.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Diversity is All You Need: Learning Skills without a Reward Function

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.263831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.263831Z digest=sha256:5ae71785b82457f928a6055cf3d59dcf5170bfa0431247408e803a42ce765e80

Observation d1a872b2-57c7-42f5-acb2-4a179194ab68 · outbound

This paper cites Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.270823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.270823Z digest=sha256:9b385e8839c23973d994e34e8c5b9eab5f356c539af67b21e6deca8fcc250e07

Observation eb952f6b-4f00-45dd-85b8-f8fecc5cd21a · outbound

This paper cites The Challenges of Exploration for Offline Reinforcement Learning.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search The Challenges of Exploration for Offline Reinforcement Learning

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.274317Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.274317Z digest=sha256:7de6f3fc5e7dc935de81db4b50c7f7970e578d4f304d8867b17931029c3f1116

Observation 3e257135-f4fd-4299-85df-0b174d38135d · outbound

This paper cites Hong, T.-Y.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Hong, T.-Y

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.709563Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.277661Z digest=sha256:c31554957f0c16701bf14ddc9a2afb1b43b7fb9a8207a813f0cef7453d9ada64

Observation 996d6b90-2aa1-494a-bba9-af38ebd027cd · outbound

This paper cites Parker-Holder, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Parker-Holder, A

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.699525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.281308Z digest=sha256:f0dfd73109c77dbf435642cf335589cddafd4e7d2fa26b76ba0acc56ec2a1c08

Observation c6ed421f-d888-4541-a690-cd02157dab5a · outbound

This paper cites Kumar, A.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Kumar, A

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.689161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.284743Z digest=sha256:4723bb5605d2b8a52be84616f16124938ac5e635196d0bbad51678b071cfa621

Observation 3aa3e3c5-fd6d-4501-ada2-2695ee97c41d · outbound

This paper cites Swazinna, S.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Swazinna, S

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.678975Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.287861Z digest=sha256:c0b7b516c39375fe01b99b1e06d2a04781e556cab1d9a545221365de4dbbd183

Observation df50044b-3177-4034-8ed4-9913996b9000 · outbound

This paper cites Brandfonbrener, W.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Brandfonbrener, W

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.668919Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.291369Z digest=sha256:d8802a0023d466e9ad2d718a76e0b6a4e293aa6b4b703a771cc47f6b30bdc3a6

Observation 27bf7d8d-8dfa-419c-aa5a-bf48bc422376 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 47

Resolution
metadata mismatch
raw_fallback, observed 2026-08-12T20:47:41.483929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.294798Z digest=sha256:4071ad57939a2c116d09d8045434b556ec1daabdd03c84a2945c2c002e7c4060

Observation 9a460be0-c110-4cb4-88e8-79c250c16adc · outbound

This paper cites Bottou, F.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Bottou, F

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.298099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.298099Z digest=sha256:42fc729bc122853fbef79ba0b70000b15247fe194b5e5e2f4b3ee90033a0b4a3

Observation 9f9efc1d-5f92-49d8-b88d-b272e3fc6313 · outbound

This paper cites Mangalam, H.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Mangalam, H

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T20:47:41.652288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.301303Z digest=sha256:e9cc0651c128ac0911364e94749515add1a4f16e5ed9ca88f899faad62958c3d

Observation d07ac0d6-aba3-4fc5-a912-3b887fd19766 · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-12T20:47:41.304665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:47:41.304665Z digest=sha256:9d7095cba82a73d9b79a9eb2d6dc8225938eb9eec07a8728966f3c28c56ecbff

Observation 0c68d80d-ed0a-4f0a-aa97-a6ec2709cb0f · outbound

This paper cites an unresolved cited work.

Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search Unresolved cited work

Reference 51

Resolution
unresolved
raw_fallback, observed 2026-08-12T20:47:41.636060Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-12T20:47:41.308466Z digest=sha256:6c6874fa303f42fed8cb31bdfdbf2dc0546cdee9696cd1e864af9db7c5034e40

Pith citing papers

No inbound Pith citation observations are available.