{"as_of":"2026-08-22T01:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93d1ac438978be2f02f8bc33c73ffb401b0dee4262c67c636b42b3bc926ce756","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:55:36.053274Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.09611/citation-record","integrity":"/paper/2501.09611/integrity","json":"/paper/2501.09611/citation-record.json","paper":"/paper/2501.09611"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.563206Z","title":"Deep Reinforcement Learning at the Edge of the Statistical Precipice","venue":null,"work_id":"982dd7dc-347d-42dd-a7d8-93b816a9b1aa","year":2021},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.884908Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:1f488b8ad0d946efeb7ca8d913952cc973abe0068564608f02fa9ef7dc2db0e1","observation_id":"3c9d7ef1-1277-49e7-b42a-5512854fa1f4","resolution":{"observed_at":"2026-08-10T19:55:36.567842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.553188Z","title":"Optimistic Posterior Sampling for Reinforcement Learning: Worst-Case Regret Bounds","venue":null,"work_id":"705f9c6e-cff8-4bfb-bfaf-85acb7b23fc2","year":2017},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.889367Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:7d44f6450832c6ecff622a1e0fa59b1552c2725767607730f7c255b2730c69e9","observation_id":"b6754f36-cb55-4b71-a168-0b2094679865","resolution":{"observed_at":"2026-08-10T19:55:36.556779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.543127Z","title":"State-Aware Variational Thompson Sampling for Deep Q-Networks","venue":null,"work_id":"a3f8f7c8-2d70-4c4f-a735-85c49373668a","year":2021},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.893260Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:77b92502e09f55463a4b19af5858bdb7945d6fc0630aef0c3ef20b23cd432cba","observation_id":"2d3b2cae-5733-4431-8455-f41cfa77d442","resolution":{"observed_at":"2026-08-10T19:55:36.546893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.532657Z","title":"Efficient Exploration through Bayesian Deep Q- Networks","venue":null,"work_id":"028dfa2a-e7e0-473e-b599-eb9e9c53d7f9","year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.897101Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:ac2e77d25f7dd6bef23a789d43d2a66f23dbe82a20ba95556ac393c479fdbc20","observation_id":"b62440ba-6fa3-4898-9788-5e8dc3b96899","resolution":{"observed_at":"2026-08-10T19:55:36.536047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.522709Z","title":"Campbell, and Sergey Levine","venue":null,"work_id":"7366134d-f6e9-4abb-b307-2b5f11a0b9c9","year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.901257Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:fa564bfb09bf59044f1a6e10df13ca6a6b6ff8fdf861f0797db4c2b92c89a945","observation_id":"9c906764-9496-4073-86e1-c5c11d07e841","resolution":{"observed_at":"2026-08-10T19:55:36.526199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.512474Z","title":"Unifying Count-Based Explo- ration and Intrinsic Motivation","venue":null,"work_id":"2b003e46-71fb-43fe-bbb8-2be186291fe3","year":2016},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.904886Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:1dd01dcf8da7de44eecabdec2a436782f1d47bfd076b4fd1905bcd1c64d162ec","observation_id":"47e0cfef-0713-421d-abc6-3240d1cabc59","resolution":{"observed_at":"2026-08-10T19:55:36.515967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.501350Z","title":"Path Integral Guided Policy Search","venue":null,"work_id":"4c936415-9962-46db-96d2-4162c0e56e2d","year":2017},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.916484Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:2a79b637cf36cec73f56fccfa47f3d4bda35021e67dc31aecf84f821eb1618f1","observation_id":"3911ed0d-f654-4491-839e-069a8661d874","resolution":{"observed_at":"2026-08-10T19:55:36.505150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.490234Z","title":"Efficient Selectivity and Backup Operators in Monte-Carlo Tree Search","venue":null,"work_id":"e9165cc8-e9eb-4f2b-8810-74aae12f6cb8","year":2006},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.920060Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:7fce73bae67499fa593013ca5b08280de0d8c2cad4bf3a9a8e503e77ab160bc0","observation_id":"94a89d7f-b0ad-46b5-aab9-716f0b2e134d","resolution":{"observed_at":"2026-08-10T19:55:36.494403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.477595Z","title":"Efficient Model-Based Reinforcement Learning through Optimistic Policy Search and Planning","venue":null,"work_id":"257a547c-9802-4690-93b8-2afc9dc9c38d","year":2020},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.923681Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:078779b06f092405b7d19846eb01b2587d67c5804bac6dc11ab8d2616804dd51","observation_id":"4ff8066b-a52f-464b-8ba5-f5194da92c20","resolution":{"observed_at":"2026-08-10T19:55:36.482103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.466058Z","title":"Noisy Networks for Exploration","venue":null,"work_id":"7295659b-63c7-4e13-bc04-20a4cd70c057","year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.927187Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:153aa22fb07004f1b80071378bfd19a512d4bb36d4c562c462e489d49147765c","observation_id":"79540c1f-c4d6-434f-b876-7135487f73b9","resolution":{"observed_at":"2026-08-10T19:55:36.469782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.453924Z","title":"Dropout as a Bayesian Approximation: Representing Model Uncertainty in Deep Learning","venue":null,"work_id":"5d0d6bc8-8ada-4a47-9fa8-bc18c2fc0a2c","year":2016},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.931391Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:9ccc11fee496a258488f549adb748e74ec3348e55ff92cfb3e406e41db1fc58e","observation_id":"2afb9886-7567-4765-b58a-4339e86e892d","resolution":{"observed_at":"2026-08-10T19:55:36.458126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.443094Z","title":"T emporal Difference Variational Auto-Encoder","venue":null,"work_id":"260dd891-4750-4132-9631-ebffa7760dfa","year":2019},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.935132Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:36ddc9ff2dab4c1e71c7e133a437e69ea60a6f20d50b8cc181f0060158c697e9","observation_id":"a7ed6cfa-5fef-422f-9d3d-b0cdc602125c","resolution":{"observed_at":"2026-08-10T19:55:36.446680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.431882Z","title":"Recurrent World Models Facilitate Policy Evolution","venue":null,"work_id":"72a922ac-5be5-4cbd-80fd-76e5691e88e0","year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.938524Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:66c458be56e0b89007e7f5d529602f8fdaf2be23d7e524a7c6d5b58638b2b58c","observation_id":"1ba54c0f-8fb2-434a-812a-65472681390f","resolution":{"observed_at":"2026-08-10T19:55:36.435816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.420107Z","title":"Learning Latent Dynamics for Planning from Pixels","venue":null,"work_id":"5ad904dc-4e3e-4601-93c8-5a859c51164f","year":2019},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.941898Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:70b700b1e3d9ba6291484a9bb8a946b4c38736430284aaed5447c60806e28072","observation_id":"0c75bf1e-9bce-42f8-879f-7625e0e10b29","resolution":{"observed_at":"2026-08-10T19:55:36.423977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:35.945334Z","title":"Harris, K","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.945334Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:eb6757a4d5074f4be10edb81554d6f223ae00468fd473139ee345322df84cb8d","observation_id":"9039ec38-4961-4629-9880-ddc0abe72d25","resolution":{"observed_at":"2026-08-10T19:55:35.945334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:35.948800Z","title":"Deep reinforcement learning that matters","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.948800Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:3d00e4cbb91b4efbbdbd4911bd0de7e7ef8fc7fe78b39e8d6984da0a2ca0b2be","observation_id":"c1817ba5-d31d-4e8b-9f5e-7fcf1a75eeac","resolution":{"observed_at":"2026-08-10T19:55:35.948800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.396688Z","title":"Near-Optimal Regret Bounds for Reinforcement Learning","venue":null,"work_id":"5673eb5a-439c-46ea-84ea-bf86f942ea1c","year":2010},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.952307Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:7c3ddaa11b71d39a4cbb901083e7cb472203083224916eaa12523f15c8bfea66","observation_id":"c3f814c6-7c94-4af6-9b1f-049a7a79a48b","resolution":{"observed_at":"2026-08-10T19:55:36.400437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10181","last_updated":"2020-03-31T17:00:42Z","snapshot_observed_at":"2026-08-14T03:09:51.898352Z","submitted_at":"2020-03-23T10:59:04Z","title":"Importance of using appropriate baselines for evaluation of data-efficiency in deep reinforcement learning for Atari","version":2},"cited_work":{"arxiv_id":"2003.10181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.10181","snapshot_observed_at":"2026-08-10T19:55:36.145460Z","title":"Importance of using appropriate baselines for evaluation of data-efficiency in deep reinforcement learning for Atari","venue":"cs.LG","work_id":"a0b7dec6-5d0d-41fc-8402-554e8211f081","year":2020},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.955722Z"},"links":{"cited_paper":"/paper/2003.10181","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:e96eefc2820dc10c209aecb37000978928813a879ba197c47f5015ecd473692e","observation_id":"59abbed8-df8b-4879-82e4-c999e0097802","resolution":{"observed_at":"2026-08-10T19:55:36.152066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.386621Z","title":"V ariational Dropout and the Local Reparameterization Trick","venue":null,"work_id":"370dafdd-d61a-45db-b0f1-5832760dc544","year":2015},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.959767Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:710cbda98500a1bf25eac2faacbcf869b7b184e8f8dae57839012de030ece84c","observation_id":"91ec0fbb-8a00-467d-ab43-64022287304d","resolution":{"observed_at":"2026-08-10T19:55:36.390199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.376056Z","title":"CURL: Contrastive Unsupervised Representations for Reinforcement Learn- ing","venue":null,"work_id":"e51c82bb-b49d-4dbc-bc24-fda4c9c1b4bc","year":2020},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.963307Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:3fb89f372d6fddf447d3b614d993725387363f513b51f247be76ed023e214d26","observation_id":"c4ddc1dc-9f5b-4b34-a035-9d63e5d7c0ab","resolution":{"observed_at":"2026-08-10T19:55:36.379986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.365859Z","title":"Guided Policy Search","venue":null,"work_id":"0caffc97-2522-4139-8efd-a16bcfcbabc9","year":2013},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.967148Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:862692af5e0a9ec4c316f348b5719650e6612a0676baaf3c8a71b1896e40a542","observation_id":"5136596c-1042-4109-9d92-e51fda210235","resolution":{"observed_at":"2026-08-10T19:55:36.369429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02596","last_updated":"2017-12-02T02:04:21Z","snapshot_observed_at":"2026-08-17T13:32:33.280915Z","submitted_at":"2017-08-08T18:13:03Z","title":"Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02596","snapshot_observed_at":"2026-08-10T19:55:35.970683Z","title":"F earing, and Sergey Levine","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.970683Z"},"links":{"cited_paper":"/paper/1708.02596","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:4bb7bd4bdb046cfa2e8441820b83e08f14f7264f6d8a1d8dd2695f1f74d900f2","observation_id":"74e99bcc-5da9-4560-9591-fb50c9421966","resolution":{"observed_at":"2026-08-10T19:55:35.970683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.354924Z","title":"Action-Conditional Video Prediction Using Deep Networks in Atari Games","venue":null,"work_id":"ff65d693-5098-42d2-87c2-96b9180ad3ae","year":2015},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.974509Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:35399397b185a217bedcb271ecfcd4c13bf1b8e5d21ab3fa6531765287e00427","observation_id":"86bcb8c5-7652-4c65-8e2d-606352d0bbe6","resolution":{"observed_at":"2026-08-10T19:55:36.358730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.00300","last_updated":"2015-07-01T17:47:01Z","snapshot_observed_at":"2026-08-18T01:14:37.450398Z","submitted_at":"2015-07-01T17:47:01Z","title":"Bootstrapped Thompson Sampling and Deep Exploration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.00300","snapshot_observed_at":"2026-08-10T19:55:35.977781Z","title":"Bootstrapped Thompson Sampling and Deep Exploration","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.977781Z"},"links":{"cited_paper":"/paper/1507.00300","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:a6721e8e4a0f413d1d5e5bc973966543258b1995e77cf557af2465473ef7ef33","observation_id":"579b6bf4-56eb-4925-a5a5-02fb1a54a727","resolution":{"observed_at":"2026-08-10T19:55:35.977781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.343924Z","title":"Why is Posterior Sampling Better than Optimism for Reinforcement Learning? InInternational Conference on Machine Learning , pages 2701–2710, 2017","venue":null,"work_id":"6eb5a3e3-5ecd-4564-b607-3760e270794b","year":2017},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.981516Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:6d648c4fbf329849d76c77b21b08dcec9778f826b0d0caf56d0c69101587cb87","observation_id":"31acf276-8501-47d5-9c22-f2131e982511","resolution":{"observed_at":"2026-08-10T19:55:36.347825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.333661Z","title":"(More) Efficient Reinforcement Learning via Posterior Sampling","venue":null,"work_id":"331237fb-1db7-4d60-ab3f-1f890980b157","year":2013},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.985031Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:313db02ff5c920ac7dcdb0f83d373ed242a40bd7a14d4277980d307babe442e3","observation_id":"eb08a996-4601-4d49-8cee-e48b2dbc7df9","resolution":{"observed_at":"2026-08-10T19:55:36.337350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.321908Z","title":"Deep Exploration via Bootstrapped DQN","venue":null,"work_id":"2bea27bf-73ad-4186-8d75-95540089eb33","year":2016},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.988762Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:7a013e341e1551b5ebb489761e5def268739d713ec807922ca4217abeb313f8c","observation_id":"a0d82c19-06b1-48e2-9b55-7a81a83a47d3","resolution":{"observed_at":"2026-08-10T19:55:36.325606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.310957Z","title":"Generalization and Exploration via Randomized Value Functions","venue":null,"work_id":"64c46c6a-be5b-46ed-8f04-870d9c18c9c9","year":2016},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.992509Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:927fdd95cd931f918ae96c1ea304c02a30d8475c805c1ad3309aca06164425a5","observation_id":"c3e4286c-2b98-4250-8750-e9eb24558df7","resolution":{"observed_at":"2026-08-10T19:55:36.314672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.300708Z","title":"Chen, Xi Chen, T amim Asfour, Pieter Abbeel, and Marcin Andrychowicz","venue":null,"work_id":"20687eaa-b0da-4a9c-9dd7-3d4f41e3af2b","year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.996018Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:f228e5610ed275e9c019b370277823a91eb33aaf58bbac126833ce4c2515f3e5","observation_id":"47196a34-5709-4e9d-a51d-ca9638fee0d9","resolution":{"observed_at":"2026-08-10T19:55:36.304401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.03864","last_updated":"2017-09-07T23:28:48Z","snapshot_observed_at":"2026-08-14T21:12:24.197125Z","submitted_at":"2017-03-10T23:02:19Z","title":"Evolution Strategies as a Scalable Alternative to Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.03864","snapshot_observed_at":"2026-08-10T19:55:35.999491Z","title":"Evolution Strategies as a Scalable Alternative to Reinforcement Learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.999491Z"},"links":{"cited_paper":"/paper/1703.03864","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:6bc5aeb573e2ca2a1c644eb4977645ec19cdb9e35f91de1037e38703ddcfa3ed","observation_id":"53751a90-4749-456a-b8e4-023df994e106","resolution":{"observed_at":"2026-08-10T19:55:35.999491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T19:55:36.003778Z","title":"Proximal Policy Optimization Algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.003778Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:289c3c133b68a98bda17979db3232103eae1c4359e77128c75140fcb2db6e5b2","observation_id":"3545d01f-97b2-4f5d-bb40-dede0c232f49","resolution":{"observed_at":"2026-08-10T19:55:36.003778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.290025Z","title":"Dropout: A Simple Way to Prevent Neural Networks from Overfitting","venue":null,"work_id":"aaa33393-b321-482d-b09d-f946480c0041","year":1929},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.007627Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:5e6b8c751b9648d051fcaacd1a2af987d560c58b7732985e89cba80db4f3b9c0","observation_id":"d9babd3d-aebf-46ab-a1fc-02767ec75d8d","resolution":{"observed_at":"2026-08-10T19:55:36.294003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.279185Z","title":"A Bayesian Framework for Reinforcement Learning","venue":null,"work_id":"86bdc125-b97b-4dfb-ac6e-668cd8debb42","year":2000},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.011690Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:f5f130ccb3ac90b1fd98735d152e156107dbb668877cee285f6a4739b8897936","observation_id":"9b392dea-4d86-489c-961f-efe6e4b9c42a","resolution":{"observed_at":"2026-08-10T19:55:36.283081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.268643Z","title":"Dyna, an Integrated Architecture for Learning, Planning, and Reacting","venue":null,"work_id":"3564cf9f-ca64-4d2d-a0aa-9088e112a77c","year":1991},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.015240Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:d0e8065867e62e098dc97e5ddc3b78e6ecc7dd53e572fdea831355652ffaa867","observation_id":"3337524b-074e-4167-8d95-62f811177037","resolution":{"observed_at":"2026-08-10T19:55:36.272519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.257145Z","title":"On the Likelihood that One Unknown Probability Exceeds Another in View of the Evidence of Two Samples","venue":null,"work_id":"089dee1b-6d7d-4e80-bf1e-fb5db517cf10","year":1933},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.019116Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:245b9a4e744781d5256e4299e041af6f2d848a1d1c41b0f1e176847908440b96","observation_id":"ae7ca540-fa42-4f2f-bfd0-c3103dd045a2","resolution":{"observed_at":"2026-08-10T19:55:36.261017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.245785Z","title":"V ariational Inference for the Multi-Armed Contextual Bandit","venue":null,"work_id":"68449bc5-3e3a-4fe7-8c53-8aa91c3f6244","year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.022895Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:2bfb455cf0afa873945830512000a3378dbbc85113f052cf8d5d901e120886c1","observation_id":"56971bb4-63ac-4527-936c-659ef8843b13","resolution":{"observed_at":"2026-08-10T19:55:36.249645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.233969Z","title":"When to Use Parametric Models in Reinforcement Learning? In NeurIPS, pages 14322–14333, 2019","venue":null,"work_id":"1406241a-ec21-4872-bba0-2a2668fac904","year":2019},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.026409Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:b7b01a86eccd933387e319425945d419fc86da7e019283824cb1caf8cd8690b8","observation_id":"04096cd6-3bb0-49d8-aa3c-df0d15ccae3d","resolution":{"observed_at":"2026-08-10T19:55:36.238370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.07416","last_updated":"2018-03-16T18:49:22Z","snapshot_observed_at":"2026-08-18T08:10:59.627198Z","submitted_at":"2018-03-16T18:49:22Z","title":"Tensor2Tensor for Neural Machine Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.07416","snapshot_observed_at":"2026-08-10T19:55:36.029987Z","title":"Gomez, Stephan Gouws, Llion Jones, Lukasz Kaiser, Nal Kalchbrenner, Niki Parmar, Ryan Sepassi, Noam Shazeer, and Jakob Uszkoreit","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.029987Z"},"links":{"cited_paper":"/paper/1803.07416","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:4768b33dddaffab0552612c41eb7b504cf7579e4e062696ea9d067335d0e8321","observation_id":"ef06e995-8512-4a23-97c7-88d960590991","resolution":{"observed_at":"2026-08-10T19:55:36.029987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.221595Z","title":"Thompson Sampling via Local Uncertainty","venue":null,"work_id":"72ad6fd6-bf23-4f11-9956-c22ff6918975","year":2020},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.034436Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:e120ff87b677b65a3f267dce5078b1934eb96d6c3474a9b77bbb5a5cb2aae92f","observation_id":"d32c3623-7c1c-4c12-a132-85d260f028ba","resolution":{"observed_at":"2026-08-10T19:55:36.225374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.01149","last_updated":"2015-10-28T13:23:51Z","snapshot_observed_at":"2026-08-14T22:33:53.863727Z","submitted_at":"2015-09-03T16:18:30Z","title":"Model Predictive Path Integral Control using Covariance Variable Importance Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.01149","snapshot_observed_at":"2026-08-10T19:55:36.038638Z","title":"Model Predictive Path Integral control Using Covariance Variable Importance Sampling","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.038638Z"},"links":{"cited_paper":"/paper/1509.01149","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:17a2a2abf939098c05213c9ee521d978c77cad84b016efd167a6fe8aa39936a6","observation_id":"f8dbd2ca-f4a8-4222-bcaa-8bfaf5e3e24d","resolution":{"observed_at":"2026-08-10T19:55:36.038638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.209628Z","title":"NADPEx: An On-Policy Temporally Consistent Exploration Method for Deep Reinforcement Learning","venue":null,"work_id":"f1bef4eb-59f7-4f9f-93c9-973e1f61d4d5","year":2019},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.042450Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:e6cbe63a416d43fa642c7ff959ba842bd93bbb6dfcedf42456bed568f36a5998","observation_id":"9c55c9e9-4909-43ce-a579-781add8af480","resolution":{"observed_at":"2026-08-10T19:55:36.213655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.197208Z","title":"Mastering atari games with limited data","venue":null,"work_id":"6997d731-8f2a-41ca-a6f3-f3c21ea576c9","year":2021},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.046040Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:85bca8c46ea933fa2bb1d9019d9839ef40727cbc2d2fad8ccf4ab67dc4531f49","observation_id":"7c5363cd-cfff-472a-8eb2-8dfa889e9bfc","resolution":{"observed_at":"2026-08-10T19:55:36.201905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.184389Z","title":"Scalable Thompson Sampling via Optimal Transport","venue":null,"work_id":"cdf07ef4-1837-40be-b6f7-285e21d1e93c","year":2019},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.049728Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:efef91a0cda6e807c39ec182c041bfc209521c77eff4d429d987e2fe1b6d5227","observation_id":"70a78d5d-c334-49f4-8b05-24380d0cd583","resolution":{"observed_at":"2026-08-10T19:55:36.188610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:55:36.173133Z","title":"Model Based Reinforcement Learning for Atari","venue":null,"work_id":"68ce668e-ad09-436f-9aee-224493f9313d","year":2020},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:36.053274Z"},"links":{"citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:0a3c4140ce03adbbec1fcfce5c57804079a50706cb763cca8f310d1ac72b3b50","observation_id":"b9521dd6-d9a3-4c31-9192-6441e53a3706","resolution":{"observed_at":"2026-08-10T19:55:36.176782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.12726","last_updated":"2020-02-19T16:04:29Z","snapshot_observed_at":"2026-08-19T23:34:47.419824Z","submitted_at":"2019-05-25T15:38:00Z","title":"Prioritized Sequence Experience Replay","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.12726","snapshot_observed_at":"2026-08-10T19:55:35.912989Z","title":null,"venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T19:55:35.912989Z"},"links":{"cited_paper":"/paper/1905.12726","citing_paper":"/paper/2501.09611"},"observation_digest":"sha256:ec8a312b8d9dc62873eeb7791de21e37964a8a5f5308fbfb1f66728ee74ec507","observation_id":"0ee6a3ed-584e-472c-80d0-afbc07236faa","resolution":{"observed_at":"2026-08-10T19:55:35.912989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.09611","last_updated":"2025-01-16T15:35:48Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-21T20:21:46.366164Z","submitted_at":"2025-01-16T15:35:48Z","title":"EVaDE : Event-Based Variational Thompson Sampling for Model-Based Reinforcement Learning"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2501.09611."}