{"as_of":"2026-08-16T10:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:beedd9f378ba826c2cb0ebe1408ae383ee5cd3537d8d10e0b77eaf86cae4a9f3","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:29:36.124264Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.03627/citation-record","integrity":"/paper/1908.03627/integrity","json":"/paper/1908.03627/citation-record.json","paper":"/paper/1908.03627"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.549665Z","title":null,"venue":null,"work_id":"b87933a9-6dd1-4107-89d6-d888dc8976fe","year":2017},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:35.993727Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:1a616859b279f933b0b73c978becb0de50009a2a961ac4a9d7dfeee2ccc0bb52","observation_id":"ea491523-757e-41c9-ada2-a9874240afc8","resolution":{"observed_at":"2026-08-14T14:29:36.554770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.000028Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.000028Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:3b1df511ecc39431792f2c727d73afccefd581fe820b68bd6264c3bdf29daf1e","observation_id":"cd3f4cb3-072d-4594-ad4a-2b9163cee433","resolution":{"observed_at":"2026-08-14T14:29:36.000028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.517414Z","title":"Target-driven visual navigation in indoor scenes using deep reinforcement learning,","venue":null,"work_id":"3e1c4b4e-66eb-4bcf-bfcc-97fb0d92be21","year":2017},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.005603Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:7cc6c73504ec5dc7b3951149a168f18c8a7d99b818dfad4e7af54e258dee3b26","observation_id":"bb3bc129-e22b-4814-9ff6-bae380648c40","resolution":{"observed_at":"2026-08-14T14:29:36.523489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.498706Z","title":"One-shot reinforcement learning for robot navigation with interactive replay,","venue":null,"work_id":"274e7dae-8318-454f-b4da-54aa5a0ea8e1","year":2017},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.011002Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:9fcd93527304fb5f05d071a4b980bed6a36d358745572d570b8ab1e8b048f42b","observation_id":"914127d9-2814-46ee-84dc-2290edccdfca","resolution":{"observed_at":"2026-08-14T14:29:36.504686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.479176Z","title":"Building generalizable agents with a realistic and rich 3d environment,","venue":null,"work_id":"02b15e95-d8bb-4148-aafa-a84b5f23af95","year":2018},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.017063Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:4604f88fd298d4c6b23cb14c2a240beea57d7ec8cca710e5ef584dfe6bcd2fcb","observation_id":"52f481c6-80fa-4fae-bc27-c9a27a59c527","resolution":{"observed_at":"2026-08-14T14:29:36.485286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.460195Z","title":"Semantic scene completion from a single depth image,","venue":null,"work_id":"01b137e9-5f26-4af2-b815-e57333177291","year":2017},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.027084Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:7dc082368cee1da22a96a6cdcda41dd9f9cf8d1703d28b383171e2f922728dcc","observation_id":"b3055c85-741e-4265-99bf-1d4bafdfd166","resolution":{"observed_at":"2026-08-14T14:29:36.466417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.439363Z","title":"Reinforcement learning with unsupervised auxiliary tasks,","venue":null,"work_id":"72c11d63-3952-4417-831a-e3eabafb893d","year":2016},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.033475Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:895f830ec6ac356ca7add5ce0debf87635cd52dd6a0f2b787e09a0b2b2b2d0a7","observation_id":"91ba2058-cfcf-46ae-9cfb-cd060b2314a9","resolution":{"observed_at":"2026-08-14T14:29:36.445114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.412305Z","title":"Learning to navigate in complex environments,","venue":null,"work_id":"45dda44c-65d0-4739-b9e4-8742301e14e8","year":2016},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.038736Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:ccd18b5bc5b896344ceba7398163d1c6596538151f7c315d11bce659ec0ee778","observation_id":"b1746e92-96c7-4c13-8dee-bdd36d8dc4e0","resolution":{"observed_at":"2026-08-14T14:29:36.418815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.395748Z","title":"Deepmind lab,","venue":null,"work_id":"80c096cf-7ebe-4f52-98ab-2f5dcdfaa192","year":2016},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.044366Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:19bca437944fa170e4b47de9a1bd4c4775f61c026d5ce056ba746bf3986a3bb9","observation_id":"36f2a107-1c73-40e6-98bb-a795de5a9375","resolution":{"observed_at":"2026-08-14T14:29:36.400795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.376808Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI,","venue":null,"work_id":"1d776464-803a-4c51-b4ff-3188f7b7fa0b","year":2017},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.049757Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:425e7345bf87265c8d8f61328749761db26a54b3aa7f84399084e56cad3a16bb","observation_id":"07e7bfdf-0a25-48ec-bd56-0e2affa91580","resolution":{"observed_at":"2026-08-14T14:29:36.382861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.05144","last_updated":"2017-08-18T11:16:36Z","snapshot_observed_at":"2026-08-14T20:40:56.267554Z","submitted_at":"2017-08-17T06:14:48Z","title":"Scalable trust-region method for deep reinforcement learning using Kronecker-factored approximation","version":2},"cited_work":{"arxiv_id":"1708.05144","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.05144","snapshot_observed_at":"2026-08-14T14:29:36.185989Z","title":"Scalable trust-region method for deep reinforcement learning using Kronecker-factored approximation","venue":"cs.LG","work_id":"6a4a24c1-fcd6-4130-9900-a3f31acc4e90","year":2017},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.054824Z"},"links":{"cited_paper":"/paper/1708.05144","citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:dd2b0b656e1095979780caed93933c0cd563b325473ed401485474ec6e2adc3f","observation_id":"9d4552a6-850f-4300-9753-e7e23d02f0c0","resolution":{"observed_at":"2026-08-14T14:29:36.194107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.357956Z","title":"A survey of actor-critic reinforcement learning: Standard and natural policy gradients,","venue":null,"work_id":"40efd577-06bd-4e26-9369-b4071211f06d","year":2012},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.060877Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:ca5e8a0b41ec96720c8b26ce1f8d7887c14db710e1060d79e43489ddbffadc16","observation_id":"71f46e2b-45fc-40c7-9c33-90cc4ddc1657","resolution":{"observed_at":"2026-08-14T14:29:36.363136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.066511Z","title":"Simple statistical gradient-following algorithms for connectionist reinforcement learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.066511Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:a4ed05b67acc1fe3c466d8ede9e567b92658244eb84cefd4938da7f403a2bee0","observation_id":"8c421d3e-d27e-4214-a7df-5c7861b37b15","resolution":{"observed_at":"2026-08-14T14:29:36.066511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.071811Z","title":"Policy gradient methods for reinforcement learning with function approxima- tion,","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.071811Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:adac7c53941c02f41aa7d0090ff6a8897513152a4db10c229f32e25b7d46246a","observation_id":"703f0371-b7e8-4bd6-8f4d-efee5f63fbc0","resolution":{"observed_at":"2026-08-14T14:29:36.071811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.324496Z","title":"Q-learning,","venue":null,"work_id":"16b9015b-1a19-477f-8af8-7b9c2c263955","year":1992},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.077112Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:8098090f2001bef00a8cf809b268d60651028266f03fe2f49cfc4783ba65c2ee","observation_id":"226d86a0-db78-470a-bbfb-1927128d1e8c","resolution":{"observed_at":"2026-08-14T14:29:36.332446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.303819Z","title":"Incremental learning of evaluation functions for absorbing markov chains: New methods and theorems,","venue":null,"work_id":"d17ee83a-0856-4dac-a79a-2faaca362e67","year":1994},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.082733Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:433f512a9881b187f4310089ec2e235ac3adc562a95d9e209e1471682da52938","observation_id":"f4783971-dc4f-4c19-ab1f-acc1bd1b6ac9","resolution":{"observed_at":"2026-08-14T14:29:36.309301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.087586Z","title":"Asynchronous methods for deep rein- forcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.087586Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:176a4870018b2d37917e28c395f60e635e808458946f2de4c3405d2ae4fc18ad","observation_id":"54400025-4e3c-49f7-b74d-e24a55c56502","resolution":{"observed_at":"2026-08-14T14:29:36.087586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.272626Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":"cfa5019c-37b2-46f8-b6d0-f2ce39d9b6c2","year":2013},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.093649Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:4bea12b1fba0af7163e5bcf44f893e2757cddcf42606146675b287c04a3a0c4d","observation_id":"5decf812-e517-419a-9a68-597d778c66d2","resolution":{"observed_at":"2026-08-14T14:29:36.277924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.099196Z","title":"Striving for simplicity: The all convolutional net,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.099196Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:14e70ca29c6fd81f1805b06b42ef4899301545b4aa39a0b3028b66bab3681c49","observation_id":"a322dc29-ac5b-4e4d-913a-4664120a4179","resolution":{"observed_at":"2026-08-14T14:29:36.099196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.104496Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.104496Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:ee392d50004aaae592f9d64af5bc36064875f7480262f921ff91ec3c65e114e8","observation_id":"b0345ef8-868b-4ae0-b52a-8b4208297275","resolution":{"observed_at":"2026-08-14T14:29:36.104496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.242659Z","title":"Learning state representation for deep actor-critic control,","venue":null,"work_id":"67e55ed7-4284-43ff-8dad-e73cf3c8c79d","year":2016},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.110747Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:7634fa38a166764ca7214a1e08dad59bb1f842b9223328f71c912d3e3291fbcb","observation_id":"c86c050c-8cd9-466a-bc3c-2ff5ca6a3041","resolution":{"observed_at":"2026-08-14T14:29:36.248484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.223793Z","title":"Dueling network architectures for deep reinforcement learning,","venue":null,"work_id":"d28cdb6c-8d0f-45a0-aa16-d69411c0abd2","year":2015},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.117684Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:dccd8c5707b02c58bf22733cd94fd8b66d1461707132febf03f7e197d16031f0","observation_id":"25ce3c15-f40b-419d-a5c8-f974d796e04e","resolution":{"observed_at":"2026-08-14T14:29:36.229852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:29:36.206248Z","title":"Deep auto-encoder neural networks in reinforcement learning,","venue":null,"work_id":"7f681d3b-fb50-4232-8332-896ae764254f","year":2010},"citing_paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:29:36.124264Z"},"links":{"citing_paper":"/paper/1908.03627"},"observation_digest":"sha256:c3d7f221af8760e8d86a88ad728ed92f4492f69d3cf6eef108e1d6056bc925ec","observation_id":"346676c4-0cac-4cb0-9f5d-33528c48936c","resolution":{"observed_at":"2026-08-14T14:29:36.211657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.03627","last_updated":"2019-11-09T12:49:43Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T14:23:01.056499Z","submitted_at":"2019-08-08T13:22:22Z","title":"Vision-based Navigation Using Deep Reinforcement Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:1908.03627."}