{"as_of":"2026-08-12T07:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c52bd276e8aa9f3d58ff4d49ee9a9d32e363ece4082baff98f6aa7f6824adbf","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:32:09.371004Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02639/citation-record","integrity":"/paper/2507.02639/integrity","json":"/paper/2507.02639/citation-record.json","paper":"/paper/2507.02639"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.382388Z","title":"Then, the function to predict the next state,fs :H→S or fs :H×A→S , can be assigned any GP prior (e.g., SVGP)","venue":null,"work_id":"b17c7755-9757-4a4f-900c-a7c90dafdcc9","year":2021},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.072509Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:bd23d1c16303410e6e8820a13609ce190be419b8979cb50b12cc0ad04862d002","observation_id":"3769e907-d752-4057-a7e3-992114634450","resolution":{"observed_at":"2026-08-06T20:32:10.444233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T20:32:07.896578Z","title":"Continuous control with deep reinforcement learning.arXiv preprint arXiv:1509.02971,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.896578Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:d671915b0dec9c6c370cadbf3eedba3447ef24de5650b5521f5cecd744955fde","observation_id":"ea5136d9-a939-444f-8742-9480df7738bb","resolution":{"observed_at":"2026-08-06T20:32:07.896578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.985712Z","title":"Description of each model is enclosed in the figure’s caption","venue":null,"work_id":"8e7892f3-57c3-4594-b9fd-6b99ddda78e5","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.194512Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:3e3a51e18a2d93ac88d24ad693a4e0db2810e8368ad117ad77c553794d920bed","observation_id":"8c73c0fb-4e37-4650-b5c7-1e43789cb9a0","resolution":{"observed_at":"2026-08-06T20:32:10.064260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.778031Z","title":"temperature","venue":null,"work_id":"f3f49a0c-7e79-43b1-8185-c87b335fbfcf","year":2017},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.251812Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:aaf25c94aa2befd431fcb8c8b62c21bf190708b7c3762c41581dd5d2786c0fed","observation_id":"7a4a3c3c-77da-408b-8e07-ba65e2c054b7","resolution":{"observed_at":"2026-08-06T20:32:09.885251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.322498Z","title":"As for what requirements are needed for posterior consistency, we need intuitively that priorπ(θ) do not excludeθ0 from its support","venue":null,"work_id":"8ab60086-2191-473a-b20a-82dd31c107fa","year":1965},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.537178Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:245ff509f9bdd083dc7625fe53ceb0bc18758ab6bb6297e1ddee94a452d044c3","observation_id":"a4f55b76-6244-42b8-91f5-600c23ab8395","resolution":{"observed_at":"2026-08-06T20:32:12.421059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.074766Z","title":"This is formalized as follows (Schwartz, 1965; Ghosal & Van der Vaart, 2017)","venue":null,"work_id":"aded31d9-592e-4e5d-9cc9-0d24df718320","year":1965},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.595056Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:08582b56223b33f9f8dbf8af56a7efe32e1d8c5eec082cb43bf305697c719dc9","observation_id":"fcd90b0e-73c5-47e5-b5d2-a9626ac9857c","resolution":{"observed_at":"2026-08-06T20:32:12.172735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.828236Z","title":null,"venue":null,"work_id":"9f4e94a1-5ada-44a8-8c86-e2e246ef0ca5","year":2008},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.670731Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:db65a2b6998e8418f83450dad39a291f4d234f8b6c2f266263400d8fdc752761","observation_id":"11ed430a-7e41-4a25-b3a7-517a3f9d46bd","resolution":{"observed_at":"2026-08-06T20:32:11.934696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.578796Z","title":"Notice that with(logn)t = 1, the above is equal to the minimax rate (best rate of estimation) for functions in the classCα(X ) (Yang & Barron, 1999)","venue":null,"work_id":"bcc88caf-db60-4671-99df-ef783cb0e0c0","year":2011},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.733204Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:02cda50d2ce57e5bc7712686b85f4433c4f94886f3fbce30dfe568bddc259cb1","observation_id":"a7b0dae8-ebe4-4c64-b46f-9566fbb021ce","resolution":{"observed_at":"2026-08-06T20:32:11.721602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.284315Z","title":"DefineHα(X ) as the Sobolev space, then: Theorem A.9(Van Der Vaart & Van Zanten (2011))","venue":null,"work_id":"d32c91ca-87ef-408e-8290-f3c4a9f4829b","year":2011},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.790574Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:4638d98e88716fb6809cf72bc1e954b5ccd13e7e9100805fd457e62a865b523c","observation_id":"6d0b4549-c527-4a97-9064-eb00c3ed9a7d","resolution":{"observed_at":"2026-08-06T20:32:11.450220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.876173Z","title":null,"venue":null,"work_id":"57c0b4c5-6155-426b-96b7-c101af37a883","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.935023Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:80f05c6003de8138fd7e70d9b044a621239d79e23e20cb461f975de4e04f1cb2","observation_id":"7e2bf8d2-0325-4f62-8837-39c181afd654","resolution":{"observed_at":"2026-08-06T20:32:10.996044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.541302Z","title":null,"venue":null,"work_id":"9eaca7d3-eb44-418a-bb2b-1dc5691e389c","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.021599Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:a8641ac4050c8188242f07450e20e5859db74064ab2eaa81ff8916bb73a5b03d","observation_id":"6180afa5-335d-4e38-869d-5825620136b5","resolution":{"observed_at":"2026-08-06T20:32:10.613039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.586077Z","title":null,"venue":null,"work_id":"90159116-dc2f-4313-ba7c-55352772591e","year":2015},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.320546Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:daf90aaf8d3c757064afed7f51a36dfec1429def9ce9028bcb432abb151d6250","observation_id":"379dbd98-baef-4992-9149-6f4343c66bcf","resolution":{"observed_at":"2026-08-06T20:32:09.665133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.479532Z","title":null,"venue":null,"work_id":"07aed0f2-ab51-43de-bf87-0845f9f93edf","year":2019},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.371004Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:71c4185457b5ae766ae5e8b1fa641f2d1649db33098537e7c1d0127dbffdba2e","observation_id":"df300faf-7bd5-41f3-9950-8c148a7c2875","resolution":{"observed_at":"2026-08-06T20:32:09.532386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.693017Z","title":"be incorporated a priori","venue":null,"work_id":"a1218aed-d8c8-465c-9b23-0e3cd1f88db8","year":2013},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.979761Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:ed3ad7dd3d0b404609402b66b59cdf75cec4fb4b894e1b6be92b516d3aca2737","observation_id":"b76c4086-3195-4ae8-aefb-fc24a148e3a5","resolution":{"observed_at":"2026-08-06T20:32:10.768612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.086411Z","title":"As stated in main paper, the issue associated with computing IGθ(st,at,st+1) is that it can be done only in a reactive setting wherest+1 is actually revealed to the agent","venue":null,"work_id":"2b7f4dec-c0c9-4f76-bf3d-6bb97904dd4d","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1948,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.870970Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:0b943d4c29db38897856675b385b1c77bf57618da417d3f6e68d461fe615304d","observation_id":"83592411-d56e-44e5-8ea4-3e6113700be5","resolution":{"observed_at":"2026-08-06T20:32:11.161549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.102253Z","title":"Planning to explore via self-supervised world models","venue":null,"work_id":"31c249a7-f5e6-43c8-968b-3307a082cf7f","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1965,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.217101Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:af2c51d8deef4d2c47a44c292c260cfd46d5288cb50b160beb0ba4b02f3fae3b","observation_id":"09935f56-6ca8-460c-ab7f-1f0d035780f6","resolution":{"observed_at":"2026-08-06T20:32:13.233946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T20:32:08.098707Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.098707Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:b4f6090dd849362211e6861cb23672d8237b977d10fbe868fba1db03e1eb1660","observation_id":"4f15c855-243a-4823-9bee-d2dc0a859558","resolution":{"observed_at":"2026-08-06T20:32:08.098707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.534022Z","title":null,"venue":null,"work_id":"c235cd01-ed80-40aa-a3ae-f2ac61244909","year":2017},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.502993Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:caa26e109dde9d86757d5635b4b655e8b86412bdc9e63d807769095572ce7266","observation_id":"78eaa033-1f4a-461e-be1b-d4d2cbff72d7","resolution":{"observed_at":"2026-08-06T20:32:12.633848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.960843Z","title":"A bayesian framework for reinforcement learning","venue":null,"work_id":"1fe45f18-2b4e-4abd-8249-d87dad811721","year":2000},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.336517Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:bb14752171fef891eef4344e5fb0210bcde37685c696a2963ddbd9d6a5ca51b4","observation_id":"a715209b-8199-485b-95b5-e021210a55a4","resolution":{"observed_at":"2026-08-06T20:32:13.054614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.11409","last_updated":"2022-03-07T12:54:27Z","snapshot_observed_at":"2026-08-10T01:16:00.200780Z","submitted_at":"2021-02-22T23:29:12Z","title":"On Feature Collapse and Deep Kernel Learning for Single Forward Pass Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.11409","snapshot_observed_at":"2026-08-06T20:32:08.390877Z","title":"On feature collapse and deep kernel learning for single forward pass uncertainty.arXiv preprint arXiv:2102.11409,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.390877Z"},"links":{"cited_paper":"/paper/2102.11409","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:e360b54b45a6af51477254b4b0e54f29ee532494e3069a95d9bbf418f5239071","observation_id":"3cf3bb99-05af-4547-8fd3-c1533e203c01","resolution":{"observed_at":"2026-08-06T20:32:08.390877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1507.00814","last_updated":"2015-11-19T22:40:30Z","snapshot_observed_at":"2026-08-01T13:17:26.224723Z","submitted_at":"2015-07-03T04:11:15Z","title":"Incentivizing Exploration In Reinforcement Learning With Deep Predictive Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.00814","snapshot_observed_at":"2026-08-06T20:32:08.296177Z","title":"Incentivizing exploration in reinforcement learning with deep predictive models.arXiv preprint arXiv:1507.00814,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.296177Z"},"links":{"cited_paper":"/paper/1507.00814","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:7fd5c6caa28a04efeedd13a22e0f2a16093b44140495ce37731fd2940050c02a","observation_id":"d71a2f10-b44e-43c8-9554-db93a73f34ed","resolution":{"observed_at":"2026-08-06T20:32:08.296177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1112.5745","last_updated":"2011-12-24T17:53:19Z","snapshot_observed_at":"2026-07-06T02:40:01.191970Z","submitted_at":"2011-12-24T17:53:19Z","title":"Bayesian Active Learning for Classification and Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1112.5745","snapshot_observed_at":"2026-08-06T20:32:07.827204Z","title":"Bayesian active learning for classification and preference learning.arXiv preprint arXiv:1112.5745,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.827204Z"},"links":{"cited_paper":"/paper/1112.5745","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:03977a0f11e9516ef7b5d36d2052450ff58fc67e74065167aed885e3871db145","observation_id":"3b4e5787-5471-46f2-a869-b61ab6c8bfe9","resolution":{"observed_at":"2026-08-06T20:32:07.827204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.296592Z","title":"A unifying view of sparse approximate gaussian process regression","venue":null,"work_id":"9975d14c-1b35-417b-a02c-e25279e7c4f2","year":1939},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.011834Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:fe4a1f6c608b24d015e66fd3a0c54ec56647a4047de0149cc5f24b9218875f0a","observation_id":"c18ec8ce-613f-45ee-b7af-06ee22a14b17","resolution":{"observed_at":"2026-08-06T20:32:13.412169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.478413Z","title":"On a measure of the information provided by an experiment.The Annals of Mathematical Statistics, 27(4):986–1005,","venue":null,"work_id":"41d1f817-b483-4c1e-b3d8-5c3946698b31","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.946615Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:e65425c9b27c5be8f74f6314c37740a1e6a82603832608ee3c9fac5a3721b37f","observation_id":"a504bef3-d124-4b8c-a59a-df4f7fcb9888","resolution":{"observed_at":"2026-08-06T20:32:13.625468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.193239Z","title":null,"venue":null,"work_id":"f7b52e1c-df01-4376-97da-289ab5ce086a","year":2021},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.148780Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:a3580b894072d34456287929b50dee42238ca78004ecba1975994599f8ee4720","observation_id":"bdc0d988-8886-4eea-aff3-36cb20fc6265","resolution":{"observed_at":"2026-08-06T20:32:10.306965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.791739Z","title":"Posterior consistency of dirichlet mixtures in density estimation","venue":null,"work_id":"7cb414dc-e85e-4588-b953-a423942e7bb9","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.725405Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:0b8c9a5558f66fe8a49315c58a07afb6912cf55e39f81938145dca433c9be1ab","observation_id":"975aee35-52d6-464a-b8b6-5b95c548c023","resolution":{"observed_at":"2026-08-06T20:32:13.938358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:14.105449Z","title":"Intrinsic motivation and reinforcement learning.Intrinsically motivated learning in natural and artificial systems, pp","venue":null,"work_id":"ef6fb5ab-bfa8-471d-9352-a9e358388a53","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.619784Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:1b24fcd1c017aea40b4e08f305e644202fcbb9586251ab0618879f3272e79c0b","observation_id":"55cce8e3-083b-4e2e-a4c2-9853649e1701","resolution":{"observed_at":"2026-08-06T20:32:14.225076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.757613Z","title":"Stochastic variational deep kernel learning","venue":null,"work_id":"f990dc1f-7ded-4647-be93-ec57705b8252","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.438262Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:6b0f28bc87343ec0cbf0fd18f716215b46e8d95561bf4d5fa8c15107a49748fc","observation_id":"5bce1c38-d3dc-4f60-aa41-9136ac3bab57","resolution":{"observed_at":"2026-08-06T20:32:12.825369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-06T20:32:07.655869Z","title":"D4rl: Datasets for deep data-driven reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.655869Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:07e1005070950d672dc715be0d7c34c90005cc5a0a20ca36163f6af47f76a6c8","observation_id":"41516c33-e533-4df7-804d-da608299af87","resolution":{"observed_at":"2026-08-06T20:32:07.655869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T09:37:19.187638Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2507.02639."}