{"as_of":"2026-08-17T00:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:920f7bbfb08586dcb4af4c60a12f09d39e47642db08a2a3b1b34812955585d97","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T11:19:22.258041Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.09381/citation-record","integrity":"/paper/1908.09381/integrity","json":"/paper/1908.09381/citation-record.json","paper":"/paper/1908.09381"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.117550Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.117550Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:fdcddc53c68bd4a8fb16e5b9ea107111bc3d46453334c809858b084f5da855b6","observation_id":"41a56b4a-69c0-41d5-8ced-f58852a50236","resolution":{"observed_at":"2026-08-14T11:19:22.117550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.681075Z","title":"Trust region policy optimization,","venue":null,"work_id":"a9d5f058-2a17-40ec-9e9d-a17c275ac177","year":2015},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.122553Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:399831ae688df79dac07b5078adcb3de56da39274ff51cea314fe919c0043745","observation_id":"34b5f5e6-372e-4ddb-bac8-8dd328139ddb","resolution":{"observed_at":"2026-08-14T11:19:22.686059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.668495Z","title":"Reinbo: Machine learning pipeline search and conﬁguration with bayesian optimization embedded reinforcement learning,","venue":null,"work_id":"52130026-9a70-4135-8b61-9488c410da77","year":2019},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.126740Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:1b9b35de49d61507e4de9772715105767b044f7469ea8c69f8a87a1683b05605","observation_id":"53a2da0f-3a21-46e5-9e5d-dca411c68370","resolution":{"observed_at":"2026-08-14T11:19:22.673094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.655098Z","title":"Vime: Variational information maximizing exploration,","venue":null,"work_id":"7e2b9b6a-579e-40e6-bb20-4d35e1370650","year":2016},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.132104Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:e1ad6b94f45a217376ea91d10d34b8966b681e6f2e4f6c54ebe0e2d79cb69fe0","observation_id":"2cc04347-7b90-4337-a570-f6f916971ac7","resolution":{"observed_at":"2026-08-14T11:19:22.660322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.04325","last_updated":"2018-06-11T15:27:18Z","snapshot_observed_at":"2026-08-16T09:08:33.104938Z","submitted_at":"2018-02-12T19:38:44Z","title":"Efficient Model-Based Deep Reinforcement Learning with Variational State Tabulation","version":2},"cited_work":{"arxiv_id":"1802.04325","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.04325","snapshot_observed_at":"2026-08-14T11:19:22.439685Z","title":"Efficient Model-Based Deep Reinforcement Learning with Variational State Tabulation","venue":"cs.LG","work_id":"b59d5fea-4f25-43a2-bf62-4f477f2ab4c1","year":2018},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.136207Z"},"links":{"cited_paper":"/paper/1802.04325","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:7ee1aac46650eae460c64d55fc29f021155e77018282646125498772ec0787a5","observation_id":"517e7983-3f4e-4858-a0ba-af5fa8867c7f","resolution":{"observed_at":"2026-08-14T11:19:22.444271Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.641022Z","title":"Variational inference: A review for statisticians,","venue":null,"work_id":"954630f0-9268-4a77-b1d6-27db1fe77710","year":2017},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.141150Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:2bfed3393d2844e381e1b469510acd8313f3732472d69c3b400852b131f820eb","observation_id":"e6f5fdb2-de3d-415d-a3d1-d15ab83a9570","resolution":{"observed_at":"2026-08-14T11:19:22.645681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.145324Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.145324Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:6578a6346ad047dd9193ed25a20dda585c3bf2fe0f81ab8df818af60d7fa0d2f","observation_id":"d53cf052-6c6a-41c5-a8a8-2dd427f24d8f","resolution":{"observed_at":"2026-08-14T11:19:22.145324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.621710Z","title":"Training restricted boltzmann machines: An introduction,","venue":null,"work_id":"c6511b14-8d67-4297-81d8-660b9ec75cb1","year":2014},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.149687Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:cb65f8b3b76dc36640505f67ac44072f047416a5765762177337a8146e35e7c4","observation_id":"dfd5798b-fb44-406c-9277-41d060109ead","resolution":{"observed_at":"2026-08-14T11:19:22.626002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.609700Z","title":"Variational resampling based assessment of deep neural networks under distribution shift,","venue":null,"work_id":"62d24545-667b-425e-bff6-79b4c200fe58","year":2019},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.153544Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:c98abc0e99c6a275e3b856206fa378d724f50718adb3ffb318dafc3b8b38c54f","observation_id":"6f299b91-d757-4206-a01d-e356519420ee","resolution":{"observed_at":"2026-08-14T11:19:22.613750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.05424","last_updated":"2015-05-21T14:07:23Z","snapshot_observed_at":"2026-08-16T09:07:11.255120Z","submitted_at":"2015-05-20T15:39:48Z","title":"Weight Uncertainty in Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.05424","snapshot_observed_at":"2026-08-14T11:19:22.157313Z","title":"Weight uncertainty in neural networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.157313Z"},"links":{"cited_paper":"/paper/1505.05424","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:40121fa9e3236857ce84f5399a44d6a8b7ab8d8ec6ad0a5591d2074c1f89cab2","observation_id":"e671edd8-c719-4943-83b7-9db33f5a4844","resolution":{"observed_at":"2026-08-14T11:19:22.157313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-14T11:19:22.162379Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.162379Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:428847ac6f8077b92f449b83b298037a5d16342478188deab87f399e998db5d2","observation_id":"0244c9d1-6554-4c5e-9486-78b19a06b0a6","resolution":{"observed_at":"2026-08-14T11:19:22.162379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.597678Z","title":null,"venue":null,"work_id":"a83c8447-bf4a-4be6-a585-6703c0227246","year":1998},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.166439Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:65898239f4eff8bfcd31152fd45e89537e23a799d79ead2b05e53d0808b98d0d","observation_id":"c16ceaad-eb0a-4329-a718-9a740044942e","resolution":{"observed_at":"2026-08-14T11:19:22.601892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-08-08T20:31:18.897748Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-08-14T11:19:22.170282Z","title":"Reinforcement learning and control as probabilistic infer- ence: Tutorial and review,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.170282Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:956cf4efd047e5d98e1a673d15f4afea973dbfe1343301ecdfdf366c52cd6b83","observation_id":"adf0619e-39d0-4286-907a-a6c2e4bea36e","resolution":{"observed_at":"2026-08-14T11:19:22.170282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.08786","last_updated":"2020-05-24T08:21:11Z","snapshot_observed_at":"2026-08-14T21:45:35.624922Z","submitted_at":"2019-05-21T11:38:39Z","title":"Maximum Entropy-Regularized Multi-Goal Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1905.08786","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.08786","snapshot_observed_at":"2026-08-14T11:19:22.385810Z","title":"Maximum Entropy-Regularized Multi-Goal Reinforcement Learning","venue":"cs.LG","work_id":"ec9e224e-ae09-4150-810c-921411eeb60f","year":2019},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.175142Z"},"links":{"cited_paper":"/paper/1905.08786","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:68f6d7481d48503ca0500bad24829dd5120a1aac0f27301120a704ee98d02724","observation_id":"6c38d083-b9e3-49df-b5ff-9bce1ddc8171","resolution":{"observed_at":"2026-08-14T11:19:22.391728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.584485Z","title":"Planning and acting in partially observable stochastic domains,","venue":null,"work_id":"adcab1c1-3494-4635-966e-ff8a6772c20d","year":1998},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.179785Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:cafaea0656af078dd097c3f1de9f40548a49dc5649484dc628a96ee3754e468c","observation_id":"becf7472-a3a8-4c5b-b9ec-963868d65af0","resolution":{"observed_at":"2026-08-14T11:19:22.589390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.572579Z","title":"Deep reinforcement learning with double q-learning,","venue":null,"work_id":"0cb737ab-aeda-4dc5-b2fb-7cab11197f60","year":2016},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.184607Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:51367143d1d81c44f3a8f367bc1cddd67cac058454e41d0686ae0ce23d8fd2cc","observation_id":"5bb0a6e7-4049-4450-b4a9-f4614149ede5","resolution":{"observed_at":"2026-08-14T11:19:22.576565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T11:19:22.188655Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.188655Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:b79eff82c9baa253cd355970952a02808647d732e7c9b375d99c4f2586c9c743","observation_id":"4146b11f-dc4a-4dc9-b748-3b2e4d6ffc43","resolution":{"observed_at":"2026-08-14T11:19:22.188655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.559909Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"88255387-f0b7-4372-95b4-27c54d8e24e6","year":2014},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.193027Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:193e6d9ae0c81d38b24b379a74524b52f6738092bdb1126fb331b89f3fd54d24","observation_id":"7c751d78-5642-462c-bc5f-192e700db089","resolution":{"observed_at":"2026-08-14T11:19:22.564144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.546992Z","title":"Asynchronous methods for deep rein- forcement learning,","venue":null,"work_id":"0da0dc88-66fe-4ea4-8069-117f35dd4573","year":2016},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.198384Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:f8631a7c7bfba5d012025d8e0b96588487aa831b0bf675882a4c95e73ba22a43","observation_id":"de38d8af-4da1-40b4-aa69-57099354f489","resolution":{"observed_at":"2026-08-14T11:19:22.551686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-14T11:19:22.205452Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.205452Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:82e14aabce73a11af06cf9bf13c075b41df815341fdfe8d731605250877d0f1b","observation_id":"d46e569f-c7f0-47f0-a7f7-c1f1708b7922","resolution":{"observed_at":"2026-08-14T11:19:22.205452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.534493Z","title":"Universal value func- tion approximators,","venue":null,"work_id":"357373bd-c5a3-4d7c-99b6-4a73c8a2d0fb","year":2015},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.209774Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:8ffa8e7cf1d5ef5811fda890a15dc1866e9e2678dfa03c1b2a44d62e7ac58d63","observation_id":"a03113c0-a74d-421c-99fd-a166347e0eea","resolution":{"observed_at":"2026-08-14T11:19:22.538966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.521749Z","title":"A lesson learned from pmf based approach for semantic recommender system,","venue":null,"work_id":"46ccb184-d2d9-4e79-b8b0-357a08b0d342","year":2018},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.214195Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:1a6c945215839cf3d98d88ebce7e17175e9419c600b06ed36e91be0187928a4c","observation_id":"2eff6a1b-a1a1-428e-9d13-d5fa9c0f86f9","resolution":{"observed_at":"2026-08-14T11:19:22.526526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.508310Z","title":"Hindsight expe- rience replay,","venue":null,"work_id":"0a4cdfd8-2f03-4b8f-a0dd-2c15286aade1","year":2017},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.219314Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:6610ca3a7c94277ceaddb633b3a7fad150afbb7c6d0adaff73d51ca5bc43af24","observation_id":"789a2179-8c90-4868-ab45-91948c70252c","resolution":{"observed_at":"2026-08-14T11:19:22.512790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05952","last_updated":"2016-02-25T17:55:31Z","snapshot_observed_at":"2026-08-15T17:33:32.559096Z","submitted_at":"2015-11-18T20:54:44Z","title":"Prioritized Experience Replay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05952","snapshot_observed_at":"2026-08-14T11:19:22.223090Z","title":"Prioritized experience replay,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.223090Z"},"links":{"cited_paper":"/paper/1511.05952","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:8cd9290025eb496246a21d2a2da233321f75a82d9128e569309d6b10ce064d66","observation_id":"f613ccfc-5be1-4db7-a5f3-21f3190ec92e","resolution":{"observed_at":"2026-08-14T11:19:22.223090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08999","last_updated":"2019-08-08T21:21:46Z","snapshot_observed_at":"2026-08-14T17:12:05.444744Z","submitted_at":"2019-02-24T19:48:30Z","title":"High Dimensional Restrictive Federated Model Selection with multi-objective Bayesian Optimization over shifted distributions","version":2},"cited_work":{"arxiv_id":"1902.08999","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.08999","snapshot_observed_at":"2026-08-14T11:19:22.330706Z","title":"High Dimensional Restrictive Federated Model Selection with multi-objective Bayesian Optimization over shifted distributions","venue":"cs.LG","work_id":"e164dc87-80a5-4d68-b305-0050b283aa7b","year":2019},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.228167Z"},"links":{"cited_paper":"/paper/1902.08999","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:29a4e8c2addef998da4b17291682798e685bc08fd176491615c67c2a36ef7bf1","observation_id":"ba713fd5-f5fb-41cd-bb43-8c1caa94f65c","resolution":{"observed_at":"2026-08-14T11:19:22.337324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.494878Z","title":"Approximately optimal approximate rein- forcement learning,","venue":null,"work_id":"19989786-9a73-4695-bfb7-ef6d4d665e4f","year":2002},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.232519Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:420d8439473e4998c68863aa900c494ab9f6506f89bd6e4fd1c128faf25d55da","observation_id":"e675ed03-0f6f-4d51-a434-eff06c9c4c33","resolution":{"observed_at":"2026-08-14T11:19:22.499711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.480533Z","title":"Reinforcement learning with factored states and actions,","venue":null,"work_id":"352da944-685b-44d5-a2ab-0d557c1d378d","year":2004},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.236441Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:41ccef2ee4aff161569d358859df6d8bf94922ee361e555b10cf92b61e177289","observation_id":"1383a316-daf6-45af-a4c5-a5ee9772ac7b","resolution":{"observed_at":"2026-08-14T11:19:22.485712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.466560Z","title":"Reinforcement learning with deep energy-based policies,","venue":null,"work_id":"b54cbd04-c1ee-4bab-abb0-0604a719237a","year":2017},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.240764Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:34c70ed8a14f743f7af6d060cbdf4e00e4e08d8365524cbc08fdcb1a9ee178fd","observation_id":"79c8de57-6c8f-4e53-82ad-4164d9c9056d","resolution":{"observed_at":"2026-08-14T11:19:22.471133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-14T11:19:22.245109Z","title":"Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.245109Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:e1774997e28c6f1848d96f3c0ce722c4e4bdf74b3a28362ac12865c467ca9c2f","observation_id":"3bb557b2-a664-48f6-939e-f77348bd19aa","resolution":{"observed_at":"2026-08-14T11:19:22.245109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T11:19:22.453884Z","title":"Planning to be surprised: Op- timal bayesian exploration in dynamic environments,","venue":null,"work_id":"8d1758e6-09c2-4319-ace9-baa74f567e4b","year":2011},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.249723Z"},"links":{"citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:460da3b7386bae95507471a96ba1ded794fd9016dfc5b79049277bdd81c57cd0","observation_id":"388e9c4e-827e-454b-89ce-7b7ad724140a","resolution":{"observed_at":"2026-08-14T11:19:22.457839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05908","last_updated":"2021-01-03T16:56:46Z","snapshot_observed_at":"2026-08-14T21:52:07.048587Z","submitted_at":"2016-06-19T21:02:30Z","title":"Tutorial on Variational Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05908","snapshot_observed_at":"2026-08-14T11:19:22.254123Z","title":"Tutorial on variational autoencoders,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.254123Z"},"links":{"cited_paper":"/paper/1606.05908","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:2d23ba4e6c69b088e94ab76a932af7cab4f60a3ce8882f7a1459037a1be7d050","observation_id":"ec8bc9f9-11c1-4d54-9c1b-592add75a74f","resolution":{"observed_at":"2026-08-14T11:19:22.254123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.00712","last_updated":"2017-03-05T16:59:44Z","snapshot_observed_at":"2026-08-15T03:06:21.621383Z","submitted_at":"2016-11-02T18:25:40Z","title":"The Concrete Distribution: A Continuous Relaxation of Discrete Random Variables","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.00712","snapshot_observed_at":"2026-08-14T11:19:22.258041Z","title":"The concrete distribution: A continuous relaxation of discrete random variables,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T11:19:22.258041Z"},"links":{"cited_paper":"/paper/1611.00712","citing_paper":"/paper/1908.09381"},"observation_digest":"sha256:238a5940a079b7bb04363780e3b0c4f95ebe015442ba722e0b188dd2069b9454","observation_id":"ef9ad3b4-f4fe-42ad-bb96-f545b5c510d4","resolution":{"observed_at":"2026-08-14T11:19:22.258041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1908.09381","last_updated":"2019-12-08T11:44:35Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T13:07:48.738067Z","submitted_at":"2019-08-25T19:36:36Z","title":"Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":3,"verified_fuzzy":17},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:1908.09381."}