{"as_of":"2026-08-16T08:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93d97ede0e248b1c4935be34c8738014ee3740298a0ec88f52d21e99e6068e4d","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:30:29.363097Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.01007/citation-record","integrity":"/paper/1908.01007/integrity","json":"/paper/1908.01007/citation-record.json","paper":"/paper/1908.01007"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.225079Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.225079Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:43fe6e6616775cd1830bc906d5280c8bafc4cab22bfa82256adb9cbd7b9467c1","observation_id":"e23ddbb0-d7e3-445f-88b0-e5aff5a5f429","resolution":{"observed_at":"2026-08-14T15:30:29.225079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.867783Z","title":null,"venue":null,"work_id":"fd00c095-d6bb-4150-893c-d36d0b5f2422","year":2004},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.230852Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:88a037f3a3f663f9bc2e0f4279d7035dbc63874d19ac6acf89206d09cb141206","observation_id":"4bbdd073-01bb-4e46-a7b2-7b6e95a262d9","resolution":{"observed_at":"2026-08-14T15:30:29.873989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1603.04119","last_updated":"2016-03-14T03:16:25Z","snapshot_observed_at":"2026-08-15T09:51:28.162317Z","submitted_at":"2016-03-14T03:16:25Z","title":"Exploratory Gradient Boosting for Reinforcement Learning in Complex Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.04119","snapshot_observed_at":"2026-08-14T15:30:29.235726Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.235726Z"},"links":{"cited_paper":"/paper/1603.04119","citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:73960f786c4846eb7b3ed6f3ec467d5fb18dc987543cf04d413c9e7520125bd2","observation_id":"1ee39351-b897-47f1-996a-fdfacaf85eb4","resolution":{"observed_at":"2026-08-14T15:30:29.235726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.845684Z","title":"D., Chernova, S., Veloso, M., & Browning, B","venue":null,"work_id":"701e5586-0bf2-401a-be7c-4d349a565fe9","year":2009},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.241262Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:445717edfa7957c2e71672c90f40bc093bc3141a76cb8ee083d598210b75d1f1","observation_id":"a5d11cc1-12b5-4f49-ac00-b7b6416f18e5","resolution":{"observed_at":"2026-08-14T15:30:29.853001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.822247Z","title":"F., Leike, J., Brown, T., Martic, M., Legg, S., & Amodei, D","venue":null,"work_id":"4f0b504e-c969-4280-aebc-54af25dc5cd9","year":2017},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.245853Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:543ca4c290b512e4c760dc512cbbf1bcb720d98afd7c9a19bdbbff0d9d8f5220","observation_id":"9ca1bf7e-2990-47a0-b0af-fd5a6bf2b109","resolution":{"observed_at":"2026-08-14T15:30:29.828910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.805364Z","title":"P., & Zaremba, W","venue":null,"work_id":"7c6c7803-2792-4941-8a98-1b5ac42d1119","year":2017},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.250101Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:556bd7be529c553ba24d0475d561b827110087412ef4cfeac3dbd2cfdb940a09","observation_id":"c99502c5-da42-4604-9b3c-a605f847db97","resolution":{"observed_at":"2026-08-14T15:30:29.810790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.791618Z","title":"A., & Olsen Jr, D","venue":null,"work_id":"42d1f345-4b22-4366-a904-8f1f86d37ac6","year":2003},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.254251Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:1d31be4b36dede02caae714ba5086d89e7e66f98c7bc02eed866642443fe2fbb","observation_id":"0060a118-e41d-485b-a7e4-e6351f9fa2aa","resolution":{"observed_at":"2026-08-14T15:30:29.796492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05313","last_updated":"2019-05-30T04:39:22Z","snapshot_observed_at":"2026-08-15T20:01:11.309417Z","submitted_at":"2018-02-14T20:37:38Z","title":"Reinforcement Learning from Imperfect Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05313","snapshot_observed_at":"2026-08-14T15:30:29.258845Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.258845Z"},"links":{"cited_paper":"/paper/1802.05313","citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:c47a388ba1f6ad79bf004b9edccdbc2bc9a9ee798bdfda0c9634b8193f460670","observation_id":"ddb0e2e0-e3c9-49f2-a468-65aa7e673f5f","resolution":{"observed_at":"2026-08-14T15:30:29.258845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.778381Z","title":"L., & Thomaz, A","venue":null,"work_id":"250a0552-c9b2-44ea-849f-25357294f169","year":2013},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.263562Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:6949f5d0c2717066a2a8fa43f662d8361b2dc85ddf188b4b18c81e74a55f2bdc","observation_id":"f3881bb9-1578-4296-b736-55c800d7fc93","resolution":{"observed_at":"2026-08-14T15:30:29.782414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.765460Z","title":null,"venue":null,"work_id":"132ae141-225e-47ba-9532-2ed62e3ab574","year":2016},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.268278Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:d332538c45a84c1f1e388c0b91e53dbd42809e68d6b40e72eda3deaa72e17c9b","observation_id":"f4a1111c-d6e5-416d-8c95-472a070a6ce1","resolution":{"observed_at":"2026-08-14T15:30:29.770662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.06527","last_updated":"2017-01-11T20:25:54Z","snapshot_observed_at":"2026-08-14T22:39:17.382664Z","submitted_at":"2015-07-23T15:16:46Z","title":"Deep Recurrent Q-Learning for Partially Observable MDPs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.06527","snapshot_observed_at":"2026-08-14T15:30:29.272184Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.272184Z"},"links":{"cited_paper":"/paper/1507.06527","citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:786f81c6e3b26f8fb504be5f6db565f343cde069566edcfd676296510612f582","observation_id":"1c76fec4-95e1-4167-8393-dcd705f9760f","resolution":{"observed_at":"2026-08-14T15:30:29.272184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.753218Z","title":"L., & Shelton, C","venue":null,"work_id":"caf081ac-727e-4e14-bf68-b9e2252824c5","year":2002},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.276983Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:04ed21af4e45d451ceeaa8df9e37655f69256d11f4405e6b3a952d1fbed837a0","observation_id":"e8c0a9a0-7094-46f2-b489-cea75886b93b","resolution":{"observed_at":"2026-08-14T15:30:29.757312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01281","last_updated":"2018-07-03T16:57:18Z","snapshot_observed_at":"2026-08-15T14:56:35.422342Z","submitted_at":"2018-07-03T16:57:18Z","title":"Human-level performance in first-person multiplayer games with population-based deep reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01281","snapshot_observed_at":"2026-08-14T15:30:29.280993Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.280993Z"},"links":{"cited_paper":"/paper/1807.01281","citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:62d2d1aea227d4170c8de0a18e394be082f2f603ea179b51878673fafa8553ff","observation_id":"90b02878-7db8-4891-b148-28908ca2b3e7","resolution":{"observed_at":"2026-08-14T15:30:29.280993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.736016Z","title":null,"venue":null,"work_id":"304b6669-71f1-4512-820b-09132bc34594","year":2016},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.285180Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:c193a29e426511c0d94091d26f4a9f5116deea5354f85ef78c2398385d23e8e3","observation_id":"763ca4ef-b718-4282-a3e9-02880d670203","resolution":{"observed_at":"2026-08-14T15:30:29.740841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.721194Z","title":"P., Littman, M","venue":null,"work_id":"ab6016f2-98da-45a6-b503-f93555481e12","year":1998},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.289139Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:c0343f31b2934f772ec8997cc7106c4ed4c8cbb5f6d01632583af45d1ddee9ae","observation_id":"cac1bf44-95e4-42b5-ad46-09b66ff14c46","resolution":{"observed_at":"2026-08-14T15:30:29.726390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.705547Z","title":null,"venue":null,"work_id":"c8691c73-f81d-41a0-91e9-0fb3e62bcbd0","year":2016},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.293207Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:765071bd8757886488ed43f602e10507964a57f47869a4effa90d74cddb3d3df","observation_id":"ac65de2f-184b-4174-b213-e93ebc7c4e02","resolution":{"observed_at":"2026-08-14T15:30:29.711081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.689726Z","title":"B., Stone, P., & Breazeal, C","venue":null,"work_id":"8afe980f-461c-4512-8645-06df4f3a4df1","year":2013},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.297349Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:3e6934851e14d2cd60e499adbf63ea31c9c78f9299c6749c50b234ebc89edd2a","observation_id":"34815dc1-d64e-4d8f-9d50-9d8046ddd567","resolution":{"observed_at":"2026-08-14T15:30:29.694358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.05821","last_updated":"2018-04-16T17:45:32Z","snapshot_observed_at":"2026-08-14T19:25:27.425303Z","submitted_at":"2018-04-16T17:45:32Z","title":"Newtonian Action Advice: Integrating Human Verbal Instruction with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.05821","snapshot_observed_at":"2026-08-14T15:30:29.301152Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.301152Z"},"links":{"cited_paper":"/paper/1804.05821","citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:ceb8bd05ac9bf8c8c14c76db7ca3f26a6374c528f3fe7253a54ed600fd984311","observation_id":"faf8e4b6-4b8c-4ad3-bc87-49176ba7ba32","resolution":{"observed_at":"2026-08-14T15:30:29.301152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.672629Z","title":"& Feigh, K","venue":null,"work_id":"49ca296d-81a5-43db-bcd7-fe2dce04d549","year":2018},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.305974Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:09ec18457c0f61798d434a2ddd4a2f0452a918ad7441931ca76950bd43b27939","observation_id":"28fe2114-63b4-4a09-ba80-3aa003ed3372","resolution":{"observed_at":"2026-08-14T15:30:29.679457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.659360Z","title":null,"venue":null,"work_id":"2e0d6782-e2ad-4738-93fa-cf37db0a69ab","year":2013},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.310263Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:259e3284faffd956fc040d7f48eef6c9420422083c5080eb5f86c5a8441e5d38","observation_id":"fefe452f-ad34-497b-a6d5-c43030fb4595","resolution":{"observed_at":"2026-08-14T15:30:29.663704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.643164Z","title":null,"venue":null,"work_id":"7d93f0b3-6866-4f2e-9ca6-585eb366e450","year":2002},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.314437Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:43d229c61baf5f54a48f9223403ef724eb5d1bf89335aaaa506876e76d72ee47","observation_id":"ca165bf0-6d86-48df-b551-6d867c61fbe1","resolution":{"observed_at":"2026-08-14T15:30:29.647472Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.03969","last_updated":"2021-06-22T20:27:31Z","snapshot_observed_at":"2026-08-14T20:33:53.509106Z","submitted_at":"2017-09-12T17:42:21Z","title":"Explore, Exploit or Listen: Combining Human Feedback and Policy Model to Speed up Deep Reinforcement Learning in 3D Worlds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.03969","snapshot_observed_at":"2026-08-14T15:30:29.318381Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.318381Z"},"links":{"cited_paper":"/paper/1709.03969","citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:bb446c2013e37d69371646a1087df27bd2d3e5d097b20f2d0e2bec4a4a83c019","observation_id":"489a2b68-8b34-4570-98b6-7dcc973c62d5","resolution":{"observed_at":"2026-08-14T15:30:29.318381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.629062Z","title":null,"venue":null,"work_id":"71c26baf-e3f0-47f0-a155-db37b4120ecd","year":2015},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.322386Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:959bae1f3dc853fade1c9b40ea5f8bf222beb5fca1affba2bc5fd82cd5b16c3d","observation_id":"a4c33c9c-a5ce-4886-9946-10521a518bd3","resolution":{"observed_at":"2026-08-14T15:30:29.634571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.613410Z","title":null,"venue":null,"work_id":"8fbde3ab-76f4-4bcf-b520-d56d78f5a6a5","year":2016},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.326090Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:4b68a035ddfd5c9738724c0f6145b67c19724dbcb5aea899a2fb1d6af138ba16","observation_id":"871fe540-6e87-4b10-9ba3-626f90d74925","resolution":{"observed_at":"2026-08-14T15:30:29.618789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.598925Z","title":"& Hassabis, D","venue":null,"work_id":"3c9fd08e-39cb-49d0-a617-59c0e27bfa16","year":2015},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.330355Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:a8df4b67045cf38c056438e67120cced6e03e32e3e243a8ac36a391e5165e397","observation_id":"eb8f0a85-52e5-4fb7-bbb7-aa07e3a477c2","resolution":{"observed_at":"2026-08-14T15:30:29.604166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.09128","last_updated":"2016-05-30T07:40:13Z","snapshot_observed_at":"2026-08-14T21:55:11.328393Z","submitted_at":"2016-05-30T07:40:13Z","title":"Control of Memory, Active Perception, and Action in Minecraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.09128","snapshot_observed_at":"2026-08-14T15:30:29.334064Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.334064Z"},"links":{"cited_paper":"/paper/1605.09128","citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:e745a525436567b66546f10979ac164b091203ded1e66f98f7413f12a39179f9","observation_id":"38b80abf-0bca-4d2e-aaf8-2d10ff695409","resolution":{"observed_at":"2026-08-14T15:30:29.334064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.585543Z","title":"B., Kanazawa, A., Malik, J., Abbeel, P., & Levine, S","venue":null,"work_id":"16850ef7-edaa-4260-8b68-941bc9add058","year":2018},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.338286Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:b576de55506aa4af5648d0d82f4ff91c64e325aad994ee22d6ffacf08adfd473","observation_id":"69fb847d-3c45-4e09-af3a-de699ab5dd0f","resolution":{"observed_at":"2026-08-14T15:30:29.590166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.568914Z","title":null,"venue":null,"work_id":"01792c35-e390-4e11-acf6-50fe0f9b3794","year":1997},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.342747Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:70abd730259945a09587eb90f9530745a0562cf55ece235a1cbb62e35f2b4f07","observation_id":"d97b8d13-1756-4f84-ab4d-e6a625100511","resolution":{"observed_at":"2026-08-14T15:30:29.574124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.548578Z","title":"& Sorg, J","venue":null,"work_id":"32148dbb-821f-468d-b81f-120d720e6c0a","year":2010},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.347353Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:8e391613a4a42f8de622c3803310b9f1522ec09eff7468fefe4a741c5aa50f2a","observation_id":"bcff90e2-7875-470d-bdd2-1837324f617c","resolution":{"observed_at":"2026-08-14T15:30:29.554235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.532870Z","title":"S., & Barto A","venue":null,"work_id":"f2971e4d-ca65-4f22-bc7d-1b969ff91779","year":1998},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.351087Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:3676126dcab9a833981438b4f5a3015f9b7175b55e56f51b2fa94aa022a4ffb8","observation_id":"e2ab704b-6284-4edc-8db5-4cbe2c7f77b9","resolution":{"observed_at":"2026-08-14T15:30:29.538370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.516922Z","title":"L., & Breazeal, C","venue":null,"work_id":"41d00fe1-1b76-40d0-9575-e33dab8917e4","year":2006},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.354898Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:34713f7f0cb062570c238620d729b8e224813ebeba186e356753e3f98beeca2b","observation_id":"0c293ba6-8b6a-42d4-86c0-2a4d16824106","resolution":{"observed_at":"2026-08-14T15:30:29.521189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.501888Z","title":"J., & Dayan, P","venue":null,"work_id":"350e89af-b016-4f34-a82f-1d9c5687879d","year":1992},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.359421Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:4aff7d4224defb587dd697b181c8d5a8721e0315168d2bdf49d0fae10d1c97cb","observation_id":"072dfae1-81c5-48da-b3c9-1a3c496deccc","resolution":{"observed_at":"2026-08-14T15:30:29.506696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:30:29.486336Z","title":null,"venue":null,"work_id":"5c65216e-eda9-4a43-be17-5cb02618b1e7","year":2006},"citing_paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T15:30:29.363097Z"},"links":{"citing_paper":"/paper/1908.01007"},"observation_digest":"sha256:0e003fbfa88dabf8b43aad79d52cd6bb4948fac3aea27f1c332fa42cb919637d","observation_id":"d03b1e5b-dce4-4d43-8f31-cdda972422fd","resolution":{"observed_at":"2026-08-14T15:30:29.491413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.01007","last_updated":"2019-08-02T18:36:44Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T09:52:28.849599Z","submitted_at":"2019-08-02T18:36:44Z","title":"Improving Deep Reinforcement Learning in Minecraft with Action Advice"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:1908.01007."}