{"as_of":"2026-08-07T16:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:346e97155fbe80e0bffd50a2a73a7bfb9f6efd131f4a2cdc3fc17035e7d7d374","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:53:53.890488Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:36:11.767803Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T04:53:58.087145Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"cited_work":{"arxiv_id":"2507.01691","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01691","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantum reinforcement learning in dynamic environments","venue":null,"work_id":"c0badd94-49c9-4d37-97de-84337e8b900c","year":2025},"citing_paper":{"arxiv_id":"2605.20801","last_updated":"2026-07-23T09:23:52Z","snapshot_observed_at":"2026-08-02T13:36:07.666145Z","submitted_at":"2026-05-20T06:45:24Z","title":"Q-SpiRL: Quantum Spiking Reinforcement Learning for Adaptive Robot Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T04:50:37.976670Z"},"links":{"cited_paper":"/paper/2507.01691","citing_paper":"/paper/2605.20801"},"observation_digest":"sha256:e2201bedbd406a727cd5636600824998a0d3cdff9b1d54bb06313e5f92ebf937","observation_id":"59b9ada6-54ca-4ecf-b770-98fa0d460cfe","resolution":{"observed_at":"2026-05-21T04:53:58.088564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01691","snapshot_observed_at":"2026-08-02T13:36:11.767803Z","title":"Quantum reinforcement learning in dynamic environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.20801","last_updated":"2026-07-23T09:23:52Z","snapshot_observed_at":"2026-08-02T13:36:07.666145Z","submitted_at":"2026-05-20T06:45:24Z","title":"Q-SpiRL: Quantum Spiking Reinforcement Learning for Adaptive Robot Navigation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T13:36:11.767803Z"},"links":{"cited_paper":"/paper/2507.01691","citing_paper":"/paper/2605.20801"},"observation_digest":"sha256:7da2b1399ba1c76ebbb52394dc1071b14b319b148d680f1d70f21377c3a909e4","observation_id":"fc056375-29f7-4295-ad73-149d1e28b357","resolution":{"observed_at":"2026-08-02T13:36:11.767803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.01691/citation-record","integrity":"/paper/2507.01691/integrity","json":"/paper/2507.01691/citation-record.json","paper":"/paper/2507.01691"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:58.115617Z","title":", Barreto , A","venue":null,"work_id":"f9c4cb21-7da3-431d-b7dc-ca4b22023ac0","year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.204165Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:55359ecdee4eb9526990b4b9b6aa93247a3b0bde8e4832d4dc17501b28849dc5","observation_id":"353c3696-d164-4c89-a8d3-bc72eeb1ad18","resolution":{"observed_at":"2026-08-06T20:53:58.165576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.263694Z","title":", Brassard , G","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.263694Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:8536e60f024ccd266610f6ced18e99868ad636ec3e3cd8f0d83f6e48662614c8","observation_id":"955973a7-3e84-4d5b-b378-136d2f67e920","resolution":{"observed_at":"2026-08-06T20:53:49.263694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.344854Z","title":", H yer , P","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.344854Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:792f3f881fea53f110577452eddbf62987bec59bfdc270bd624524d969d57970","observation_id":"14461d0e-3afb-420c-ad4c-4cfde6f6478e","resolution":{"observed_at":"2026-08-06T20:53:49.344854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/srep00400","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:55.573778Z","title":", Cuevas , G","venue":null,"work_id":"460748b1-be85-4a78-91fa-7b575b545809","year":2012},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.430788Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:745696524adc727377d0a473295b1898b897503f22a61431450ef34f45d8a283","observation_id":"cc62b7b6-5f73-44e8-a0d3-e069e273b93c","resolution":{"observed_at":"2026-08-06T20:53:55.633462Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.498052Z","title":", Arrasmith , A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.498052Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d709ad7863793e7a21e78ba07f2eb8f76bda4ee689bb17d8da7db1feec29b939","observation_id":"2237459c-c656-48c7-ae24-14242d3920ac","resolution":{"observed_at":"2026-08-06T20:53:49.498052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09121","last_updated":"2025-08-25T16:10:12Z","snapshot_observed_at":"2026-08-07T02:29:44.516504Z","submitted_at":"2023-12-14T16:54:57Z","title":"Does provable absence of barren plateaus imply classical simulability?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09121","snapshot_observed_at":"2026-08-06T20:53:49.562993Z","title":", Larocca , M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.562993Z"},"links":{"cited_paper":"/paper/2312.09121","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0fffa37f64db66219c7259b88ded199eb883551752e2cbe29b228db99fda67e5","observation_id":"029b77e2-f599-4105-8035-db0a7f97ca51","resolution":{"observed_at":"2026-08-06T20:53:49.562993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.616688Z","title":", Yang , C.-H.H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.616688Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:9a291edb10b3f6a9d0d1a49b55bd3faa0e0559dfb5164fca8ae1210aa5778eef","observation_id":"d3744512-e590-4679-a5cd-47e66fc515e7","resolution":{"observed_at":"2026-08-06T20:53:49.616688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.683869Z","title":", Chang , Y.-J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.683869Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:2c9dd7047ea6842121f6f3cf5a7b9e2ad43d19e255cdecc5947ceaac9b7696e6","observation_id":"ef5573ed-becf-4741-a15e-2370e3302ac0","resolution":{"observed_at":"2026-08-06T20:53:49.683869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s42484-023-00116-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:55.432701Z","title":", Kerenidis , I","venue":null,"work_id":"3856ad67-80df-4ffd-a16e-f59abe7347f5","year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.742903Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:12fca328a5d841676a7ef50385148c7f7e7a3b335ff3590143d04e660692b0c1","observation_id":"7ab6526e-5e7d-44f3-9d89-b72f76b889d2","resolution":{"observed_at":"2026-08-06T20:53:55.486535Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.930320Z","title":", Yeung , D.-Y","venue":null,"work_id":"93589aa6-5d76-4374-817b-29a360765e67","year":1999},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.812620Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:105cdd4c3eaf5a88b3c9340f8d6c676341b2c1ffdd84464aefbe51add88cb5a4","observation_id":"afad38c7-5e8b-4387-9a56-bc120ceefb7c","resolution":{"observed_at":"2026-08-06T20:53:58.027833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.892361Z","title":", Rocchetto , A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.892361Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0918e6def84596f94bc67918169044aef8cd16367c6dd7a35984af93053207fc","observation_id":"6c20d084-571f-4c46-9916-d60d1ffd07e6","resolution":{"observed_at":"2026-08-06T20:53:49.892361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.947876Z","title":", Meier , U","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.947876Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:1370b31514726afc7a02a29bab71aab4a832400d8a4e20a1d2187aa7923c9bd5","observation_id":"62c5b979-489f-4188-baac-00c9f1e5b65e","resolution":{"observed_at":"2026-08-06T20:53:49.947876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.027441Z","title":", Buffoni , L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.027441Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:72c400d8e562634b6c118e1b7452b48da61eb33b95abd231f30db6bbb76b2166","observation_id":"b4bbc6a0-0edf-4414-abba-69a8b0244296","resolution":{"observed_at":"2026-08-06T20:53:50.027441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.106694Z","title":", Chen , C","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.106694Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:733bde495a604f7658853edf16bafba8ee73fdaeeb086df8fb3156455dff60e6","observation_id":"c3212aff-df09-45b1-9da5-5d0d1fab3590","resolution":{"observed_at":"2026-08-06T20:53:50.106694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.158504Z","title":", Taylor , J.M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.158504Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:cc126420c6d5395a006a1866b6247a05fe91e698fcc86de23db1a066d225765d","observation_id":"782a178f-564d-413f-b78a-09656ed33ad7","resolution":{"observed_at":"2026-08-06T20:53:50.158504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.11160","last_updated":"2018-08-08T18:30:44Z","snapshot_observed_at":"2026-07-06T06:06:51.118611Z","submitted_at":"2017-10-30T18:12:10Z","title":"Exponential improvements for quantum-accessible reinforcement learning","version":3},"cited_work":{"arxiv_id":"1710.11160","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.11160","snapshot_observed_at":"2026-08-06T20:53:56.598475Z","title":"Exponential improvements for quantum-accessible reinforcement learning","venue":"quant-ph","work_id":"ca52cee3-39f2-47e3-9988-b06394019074","year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.229737Z"},"links":{"cited_paper":"/paper/1710.11160","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:2118de99ef94848ff6c8b93e690ab4ca52692f4ae7dd5bbb18c796086d3adb37","observation_id":"44f38714-7a9a-4ea5-a902-9f374b1535ab","resolution":{"observed_at":"2026-08-06T20:53:56.660236Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.780348Z","title":", Abbeel , P","venue":null,"work_id":"bb4d7764-bcb8-4be9-8dd5-946ae4fd647c","year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.296449Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d972360580c1b4b9ca01aec3d14f35aeb7fda8efbdcf954a95c5037457456558","observation_id":"b0451e22-e228-41b0-8969-b9c5be9c7662","resolution":{"observed_at":"2026-08-06T20:53:57.868746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08617","last_updated":"2023-02-16T23:01:27Z","snapshot_observed_at":"2026-07-06T14:52:46.393912Z","submitted_at":"2023-02-16T23:01:27Z","title":"Quantum Computing Provides Exponential Regret Improvement in Episodic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2302.08617","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.08617","snapshot_observed_at":"2026-08-06T20:53:56.479763Z","title":"Quantum Computing Provides Exponential Regret Improvement in Episodic Reinforcement Learning","venue":"cs.LG","work_id":"0ac86a01-f367-46ca-a5b5-ed250583d355","year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.355747Z"},"links":{"cited_paper":"/paper/2302.08617","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:5920bb5e48d769ba484e99f95d709be8dc17e6d88b38c3ff5e1fd0f5b57204af","observation_id":"db3d71df-13c9-46a0-97c4-0eccd66cd76e","resolution":{"observed_at":"2026-08-06T20:53:56.535115Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07072","last_updated":"2025-07-08T08:38:58Z","snapshot_observed_at":"2026-07-06T18:28:47.000729Z","submitted_at":"2024-06-11T08:59:20Z","title":"On the relation between trainability and dequantization of variational quantum learning models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07072","snapshot_observed_at":"2026-08-06T20:53:50.410029Z","title":", Gyurik , C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.410029Z"},"links":{"cited_paper":"/paper/2406.07072","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:1becb7a21d45852ff1c48010babfee3f0e495fd4e533c23bb381b5fa03a16a0c","observation_id":"2edad1c7-b56f-42f5-8573-ca0a1eccbb5f","resolution":{"observed_at":"2026-08-06T20:53:50.410029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.479436Z","title":": Quantum mechanics helps in searching for a needle in a haystack","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.479436Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:e7ec4bf45641376d3673537618d884b848130256db7b824e9f56cb66566cd8b8","observation_id":"46f4b87a-7b86-4aa0-8164-b2f002be4c5a","resolution":{"observed_at":"2026-08-06T20:53:50.479436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s42484-021-00049-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:55.271353Z","title":", Dunjko , V","venue":null,"work_id":"df081b2e-6cc1-4fd4-9049-5eef0a7abd7a","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.535114Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:6d73c8858f804e59eab7aa84849fbb90a9051b911d1c5909f402ec5f8a7ef325","observation_id":"b3643d83-f85b-4755-9767-336d5e1a075a","resolution":{"observed_at":"2026-08-06T20:53:55.347003Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/1367-2630/ac5b56","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:55.126657Z","title":", W \\\"o lk , S","venue":null,"work_id":"91ea49ba-ef51-461d-bb04-99a5cc4a5015","year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.594674Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:efb302f66b5241912fc7a22cb3e414900ab716daf9a2f0c98caf560543c742f6","observation_id":"d7c9e87c-d743-407c-9e3a-c8db73e00879","resolution":{"observed_at":"2026-08-06T20:53:55.198241Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.639485Z","title":", Gyurik , C","venue":null,"work_id":"4d2b62fb-2f37-424d-9c71-7e73440197e2","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.659248Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:77d0fecca1d0b58f17a44588c7c26d84cd14335d2fae1439fbd4299123f1e38d","observation_id":"78d4e288-6e8b-4827-a920-2b06ef1336fd","resolution":{"observed_at":"2026-08-06T20:53:57.712455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/prxquantum.2.010328","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:54.956629Z","title":", Trenkwalder , L.M","venue":null,"work_id":"283e6464-e959-4ccd-8e9c-25c08e0428c3","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.734170Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:1f829b4d23649217312f9435fb854ee65b7c8fd6a86038a34d5c3b75cf4cd160","observation_id":"6d5184e5-4433-4925-8af7-488cc76fa548","resolution":{"observed_at":"2026-08-06T20:53:55.036498Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.799756Z","title":", Riemer , M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.799756Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:4ad7408f644f199528602e796dcca4ff70760b14739c57f9ab90c680cde2b404","observation_id":"6bef48a9-503d-44ff-bee1-3dc25f646107","resolution":{"observed_at":"2026-08-06T20:53:50.799756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.884301Z","title":", Sutskever , I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.884301Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:893d9dd9ab9a0f420590412748baba23fabd212885f606dae28b413fa1b6570d","observation_id":"1674c910-c3aa-4f88-b66a-003d4c04dfb9","resolution":{"observed_at":"2026-08-06T20:53:50.884301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T20:53:50.948259Z","title":", Towers , M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.948259Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:daaad5649e62ecdac1e9fb7c4ff419f0e235b1fc9694e2f9b47fe8f4069d03fe","observation_id":"d13f9c2f-48eb-4b7c-bcfb-eb1d5920cfda","resolution":{"observed_at":"2026-08-06T20:53:50.948259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T20:53:51.000022Z","title":", Hunt , J.J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.000022Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:5bcd035e4d6d67a5db15fe94148d488ee5c40fc3592ac37ba27f362f2bb45663","observation_id":"e95f4ef8-8896-4499-b714-9d3dbe563874","resolution":{"observed_at":"2026-08-06T20:53:51.000022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.052747Z","title":", Arunachalam , S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.052747Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:a1ba8d5298836d8bd72bd94ccec9e612a14b0d0dbb6547f42f2a7625a80f3eb5","observation_id":"7f5fda6e-27e9-439d-9faf-cd33575f6701","resolution":{"observed_at":"2026-08-06T20:53:51.052747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.503389Z","title":", Si , M","venue":null,"work_id":"6522750c-98e0-482c-8769-73251ac0b710","year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.141244Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:98bf14c58ddf4f50e74909a2af0bc4e3125a5f117ed7439d7c72ea986c50362f","observation_id":"c2dc4a57-ef15-4a3d-8450-b5bada63572c","resolution":{"observed_at":"2026-08-06T20:53:57.558082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.215843Z","title":", Si , M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.215843Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:adbf0569310051c280e8a7280da1ae2165e06e514b343ec827537b59b367e285","observation_id":"9e60453b-79d8-4546-b0d9-cd61ff66bfa5","resolution":{"observed_at":"2026-08-06T20:53:51.215843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00354-015-0102-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:54.803798Z","title":", Makmal , A","venue":null,"work_id":"c4b84acf-475f-4d9d-be97-90dbb0503131","year":2015},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.275869Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:a70dd1828cc2ea3743788693d87e06d0a77f72925785ad2929b89eb9b0ebef02","observation_id":"a330f1a2-7879-4b16-84de-a7f45176f5fa","resolution":{"observed_at":"2026-08-06T20:53:54.877334Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.353953Z","title":", Cohen , N.J","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.353953Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d27fed92b5195aaca86326cbb669731cb50186f455ce1e94c2721f9fc2c6d83e","observation_id":"5410c872-e49b-4dc2-b2fe-1e20b5c1ed80","resolution":{"observed_at":"2026-08-06T20:53:51.353953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28764","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:56.293722Z","title":", Makmal , A","venue":null,"work_id":"d5dc8eab-678b-4bbb-af8a-9652c155e55e","year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.423143Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:c7a078b8e2f4ff2bc59014432bc0991df13700b6dfcd884012834432246ce1a2","observation_id":"e99eca3c-c72c-425a-a24a-704bcf214ea5","resolution":{"observed_at":"2026-08-06T20:53:56.386391Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.479576Z","title":", Scherer , D.D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.479576Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:36077e789a57adb5b1d39b5c2d94ae12d3d323d22e4379acc9a7065ab0a1d92b","observation_id":"60b8c208-528c-4de4-b8d4-b7569320cf65","resolution":{"observed_at":"2026-08-06T20:53:51.479576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.565011Z","title":", Kavukcuoglu , K","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.565011Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:560e640046e5bc5566e288586033050379fe03b873574bd0856c29a09f212a99","observation_id":"0ee2d3a6-cb7f-4f35-9a87-55a4a4924d4f","resolution":{"observed_at":"2026-08-06T20:53:51.565011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02027","last_updated":"2024-12-20T10:22:48Z","snapshot_observed_at":"2026-08-03T12:47:10.004296Z","submitted_at":"2024-05-03T11:58:43Z","title":"Exponential quantum advantages in learning quantum observables from classical data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02027","snapshot_observed_at":"2026-08-06T20:53:51.652640Z","title":", Gyurik , C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.652640Z"},"links":{"cited_paper":"/paper/2405.02027","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:80588934164b23acc11ce7efda3a57db4974589272f8c03b4ca375a881d3f8c7","observation_id":"f436015a-a989-4c25-9557-b481d162b133","resolution":{"observed_at":"2026-08-06T20:53:51.652640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.725748Z","title":": A survey of reinforcement learning algorithms for dynamically varying environments","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.725748Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:7686e8e6857934cdde119a2af385fa0624ac9983682729ca8c0c03bd03116e6f","observation_id":"75c4d79f-5ecc-491a-8033-a5cb7c0a2c39","resolution":{"observed_at":"2026-08-06T20:53:51.725748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physrevx.4.031002","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:54.579489Z","title":", Dunjko , V","venue":null,"work_id":"26d30162-afee-4eea-9bfb-fde2ace094e0","year":2014},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.787914Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:8d2717684d145297279dc314bedbad64cfc5be40a33b654f6d02ce3825be3c1d","observation_id":"62f7310b-4f02-4d29-be8e-6a6d63b000b5","resolution":{"observed_at":"2026-08-06T20:53:54.668985Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.78493","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:55.983884Z","title":", Wiering , M.A","venue":null,"work_id":"a3087297-48bb-468a-a0f2-e499192ed2b6","year":2016},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.867799Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:6efba234a8686f40d8a677674e4b89ea67e931227e451ffb1307a1d70824d986","observation_id":"86015ffb-5129-418a-ab5f-49dde5ad5e7d","resolution":{"observed_at":"2026-08-06T20:53:56.044520Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.931627Z","title":": Quantum computing in the NISQ era and beyond","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.931627Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:5287537b2f0062e993a40431b2bfcf1ab37d0a7e87db93638633d97f30f9c605","observation_id":"ce160d58-29aa-43de-80f4-9384b9087661","resolution":{"observed_at":"2026-08-06T20:53:51.931627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.364808Z","title":": Markov Decision Processes: Discrete Stochastic Dynamic Programming , 1st edn","venue":null,"work_id":"4a1ad801-1188-49cf-8ae0-2682022a2238","year":1994},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.006742Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:cd32a4805f5b57281f7ad7e9dafa73b85b9b1acc542cf8740dca85be07cfa9bc","observation_id":"e4eed36f-c9ed-4f26-9521-4ec8782e9f28","resolution":{"observed_at":"2026-08-06T20:53:57.423926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.228132Z","title":": Continual learning in reinforcement environments","venue":null,"work_id":"87694ea4-3aa3-47d3-8cb7-a404d0e5c1b3","year":1994},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.089925Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:2feee97fe1e5ff9add037243f6d5ec769c8017d9d9959a52131e7bed69df58d4","observation_id":"f3c39c8b-79e7-4965-a2ed-312a537115ef","resolution":{"observed_at":"2026-08-06T20:53:57.304850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-021-03242-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:54.399304Z","title":"o mberg , T. , Schiansky , P. , Dunjko , V. , Friis , N. , Harris , N.C. , Hochberg , M. , Englund , D. , W \\","venue":null,"work_id":"84bf5e7d-f93e-4a17-ad12-523160a48094","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.157831Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0f55fddea204950e3a18e738f75eeda51872ef904ee094ed9d4c923435b90b8b","observation_id":"8e3e1632-3a8a-4d89-894e-15a5fef20b11","resolution":{"observed_at":"2026-08-06T20:53:54.459517Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.226743Z","title":", Antonoglou , I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.226743Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:1c5a8c4f3c2ad81931461f9f1ff212319c78f717b8aa9221ff6eb13cf5798a37","observation_id":"e85885c9-174d-49bb-84d1-24f6ec28ff85","resolution":{"observed_at":"2026-08-06T20:53:52.226743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.336904Z","title":", Killoran , N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.336904Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:6618551057ca95f6ab2e8753ab9318527e7f299b3a1312b18b8317bef6dd22b2","observation_id":"6388860c-6b02-4516-8ceb-2979e41349ac","resolution":{"observed_at":"2026-08-06T20:53:52.336904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s42484-025-00269-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:54.263158Z","title":", W \\\"o lk , S","venue":null,"work_id":"ef07dbb5-1e62-40e7-ab6d-5fad02e1392b","year":2025},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.432616Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:78619d916d003871493e049184c0d020c55e29c47b2e503689a5615c001bf876","observation_id":"0c9ae239-994e-48b8-a92a-f0e2da881216","resolution":{"observed_at":"2026-08-06T20:53:54.332661Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.527616Z","title":": Algorithms for quantum computation: discrete logarithms and factoring","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.527616Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:1cbefe477f8edebabd2ccf6dd53cc5eb0016207c7fa95e8aaeea83326fa3b7d4","observation_id":"0df5869b-0779-4bf7-8b0d-1bad1f827bdc","resolution":{"observed_at":"2026-08-06T20:53:52.527616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.598401Z","title":", Basso , E.W","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.598401Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:dd74e3271dad6e2b20610e3e0e8dce26bd0242473fd8d99c69140706933eaccb","observation_id":"78abdd38-7987-4232-96df-342d26cc93fc","resolution":{"observed_at":"2026-08-06T20:53:52.598401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.682047Z","title":", Jerbi , S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.682047Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:c3f2f720f42d426efe99411e181a3646e8b0db3837fdbb06e82c5094aa9ef219","observation_id":"e7c445af-f3d1-490a-a108-1d87e2f1ebaf","resolution":{"observed_at":"2026-08-06T20:53:52.682047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.115986Z","title":", Weiss , E","venue":null,"work_id":"2076fd92-1fc2-471a-9dc3-7264c25d35f6","year":2015},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.843181Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:b6a7376480d198568068ddd31daa312e4cffe0cf2a45c4a860fb455cbf0d70d8","observation_id":"4e6be170-b738-4e3c-9b5f-c927b012d8a7","resolution":{"observed_at":"2026-08-06T20:53:57.168486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/2058-9565/aaef5e","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:54.137440Z","title":", W \\\"o lk , S","venue":null,"work_id":"97d4ab22-60dc-4ae9-8294-272bbbf7cd4b","year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.964122Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d78ea64bb39eefd7406489f334d52b2cb350e6d20a67d2189831870621ac395e","observation_id":"59147d27-28a7-4caf-9de9-cef62352dade","resolution":{"observed_at":"2026-08-06T20:53:54.199744Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:56.956887Z","title":", Barto , A.G","venue":null,"work_id":"3681dd1e-dd59-43df-b811-4e6cf3766982","year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.125676Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:61bd3a14e3c8c0a40346c540b7eb34efcf679b440d9444d3cbbb81e0b6048522","observation_id":"aca432a3-74e6-48a4-96d6-6bda11498163","resolution":{"observed_at":"2026-08-06T20:53:57.029628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:56.853938Z","title":", Shazeer , N","venue":null,"work_id":"5923bc5d-2ec7-4596-b138-1bffde149b02","year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.264533Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:9ae4c76bd6e779ba53d1f0a2e2ab1d2fc38a236eeb2831aa354aafa0c12b18d2","observation_id":"7d8c3af7-7cf0-4305-b35d-397c0a360eb9","resolution":{"observed_at":"2026-08-06T20:53:56.907107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:53.358936Z","title":", Dayan , P","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.358936Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d3737ef981b6c95913eb868417ad9df83ecf0419461801f7aae3d117eb64c2da","observation_id":"28b4a498-04c2-4693-9ec1-9ab0f459b858","resolution":{"observed_at":"2026-08-06T20:53:53.358936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04741","last_updated":"2023-05-10T08:36:41Z","snapshot_observed_at":"2026-07-06T13:19:15.758425Z","submitted_at":"2022-06-09T19:23:10Z","title":"Quantum Policy Iteration via Amplitude Estimation and Grover Search -- Towards Quantum Advantage for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04741","snapshot_observed_at":"2026-08-06T20:53:53.445777Z","title":", Hein , D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.445777Z"},"links":{"cited_paper":"/paper/2206.04741","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:9a382716d11618ca47f5797d3a97ef8ff70e3e896007e76dd164166c9d22c9b6","observation_id":"16debd30-cc57-4326-94f8-eea268b67d4f","resolution":{"observed_at":"2026-08-06T20:53:53.445777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:53.517354Z","title":": Simple statistical gradient-following algorithms for connectionist reinforcement learning","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.517354Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:97fb5108f1a6f780aa6f66f4453f51bf12c43a713cf386b5f0fbcf05fc2c99d7","observation_id":"2cd75ace-30f7-4ae8-9e87-97579b73dc62","resolution":{"observed_at":"2026-08-06T20:53:53.517354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.22331/q-2025-03-12-1660","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:53.990342Z","title":", Jin , S","venue":null,"work_id":"9d84a739-9f61-4ea3-9fe2-6debec7cc1b0","year":2025},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.616842Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:c800e5741445e263c19166ddac4b26670d21cb8402eb84346d7b360e4a0568e1","observation_id":"d65a9081-75b0-42aa-95ec-22759b26015a","resolution":{"observed_at":"2026-08-06T20:53:54.070042Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10796","last_updated":"2024-06-13T17:00:41Z","snapshot_observed_at":"2026-07-06T14:54:11.599283Z","submitted_at":"2023-02-21T16:23:11Z","title":"Provably Efficient Exploration in Quantum Reinforcement Learning with Logarithmic Worst-Case Regret","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10796","snapshot_observed_at":"2026-08-06T20:53:53.706900Z","title":", Hu , J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.706900Z"},"links":{"cited_paper":"/paper/2302.10796","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:720e257f61ded97dbbf7f6326eac5f5ee113315946dd8ee6fd90186f821162e7","observation_id":"ababe30b-1db1-4bb3-947b-19622a51b47c","resolution":{"observed_at":"2026-08-06T20:53:53.706900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-06T20:53:53.781669Z","title":", Stiennon , N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.781669Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:eb03ded9cd4e764b5daa86c94a8b27a49a4cbe615c08128e02fcb7b93a4abc76","observation_id":"b4038d34-0650-4519-9b81-f71ca1e88fda","resolution":{"observed_at":"2026-08-06T20:53:53.781669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:53.890488Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.890488Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:8c8df39a419c7b571ac1faf618310ade48fdddf8b4477fed18b57ef921f9a18d","observation_id":"b7a1847b-9d24-45d1-9dab-745360ae442b","resolution":{"observed_at":"2026-08-06T20:53:53.890488Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","latest_version":1,"primary_category":"quant-ph","snapshot_observed_at":"2026-08-07T02:42:16.807049Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":35,"verified_exact":13,"verified_fuzzy":10},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 2 inbound Pith citation observations for arXiv:2507.01691."}