{"as_of":"2026-08-14T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22fe21f2989e2f82c937632e2e1bdc1755ffd44130fe44096f32f9b2ad8656f4","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:00:48.322823Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13686/citation-record","integrity":"/paper/2412.13686/integrity","json":"/paper/2412.13686/citation-record.json","paper":"/paper/2412.13686"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1708.00006","last_updated":"2017-07-31T18:00:02Z","snapshot_observed_at":"2026-08-14T20:44:08.551444Z","submitted_at":"2017-07-31T18:00:02Z","title":"Tensor Networks in a Nutshell","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.00006","snapshot_observed_at":"2026-08-11T13:00:48.008121Z","title":", Bergholm , V","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.008121Z"},"links":{"cited_paper":"/paper/1708.00006","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:d5e018f63021f553c57ea35aa3053aab286975f5c22a0113fe2ea608f2e4c857","observation_id":"7561a47e-cdc1-4adf-a495-21737f0431b1","resolution":{"observed_at":"2026-08-11T13:00:48.008121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.012325Z","title":", Wittek , P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.012325Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:6a0e434c2d6f0ad066d0d87a90cf4351511e87dc4f470ee13588b0bef411c17b","observation_id":"9bbd8f0e-d5a4-4976-a0a5-7f9d5e5cec25","resolution":{"observed_at":"2026-08-11T13:00:48.012325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.016780Z","title":", Brassard , G","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.016780Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:af89a781f20ada7150a95bcafbc2f386660e4e08cabfbe2a01747abdeca2c031","observation_id":"f7ddeb0c-842d-496c-baf2-182f75fcb0bb","resolution":{"observed_at":"2026-08-11T13:00:48.016780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.020654Z","title":", H yer , P","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.020654Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:20c8868f1e5b460a60b41e525a8d4df3bd5c2c230fcef3463314d87694d78b90","observation_id":"272ff3c7-93ba-4601-ab44-6e5cdf47e502","resolution":{"observed_at":"2026-08-11T13:00:48.020654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.024634Z","title":", Chubb , C.T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.024634Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:0daffa5db7de5b4b61f2432e7a9b00b5307c2f36c5a2e339d5b13042dabac5b2","observation_id":"7f8810bb-ef0c-4cad-a3a9-f23636a24fff","resolution":{"observed_at":"2026-08-11T13:00:48.024634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.028502Z","title":", Cuevas , G","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.028502Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:f3ca411083834373a8dba1bcd0fed203c48a3f55dc3594854e49e81c65902834","observation_id":"6ede96ff-27d1-4a09-97c8-fc68f3a32cce","resolution":{"observed_at":"2026-08-11T13:00:48.028502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-11T13:00:48.032733Z","title":", Cheung , V","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.032733Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:1c5c867861e08a42205765a6b33d13000602a5d5bf261eb98413bdc53d41c2d2","observation_id":"96456f74-d0d1-4e78-a0db-386428f191b1","resolution":{"observed_at":"2026-08-11T13:00:48.032733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.036763Z","title":", Day , A.G.R","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.036763Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:d068ded7e2f49fa31dc9d9b73fd2abafc9918facf5b481f19639b481caa944c5","observation_id":"20369643-dcc8-4094-ba0f-c4a5ff8d561e","resolution":{"observed_at":"2026-08-11T13:00:48.036763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.040531Z","title":", Arrasmith , A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.040531Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:1e3cbb0093ee57851c2642f2650d4f999467fd70ebac93ff59d5378603d7dd05","observation_id":"19e8308e-b98d-4c1a-b4db-321ed80ffc3d","resolution":{"observed_at":"2026-08-11T13:00:48.040531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09121","last_updated":"2025-08-25T16:10:12Z","snapshot_observed_at":"2026-08-13T05:02:18.084382Z","submitted_at":"2023-12-14T16:54:57Z","title":"Does provable absence of barren plateaus imply classical simulability?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09121","snapshot_observed_at":"2026-08-11T13:00:48.044328Z","title":", Larocca , M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.044328Z"},"links":{"cited_paper":"/paper/2312.09121","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:f4d16657106d4a1fdaf99fe2a08e44adc2fff1dbfb253217979e1083d73ef97f","observation_id":"b641b581-f93e-4d1c-bbcd-46569a58ac70","resolution":{"observed_at":"2026-08-11T13:00:48.044328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.048477Z","title":", Yang , C.-H.H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.048477Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:c3371a4de04b2c7be880591586eed525f67c6c323ce73c37d6fd5e2a2033420b","observation_id":"76d0de5f-47a0-4df3-b5b7-b704f78c911e","resolution":{"observed_at":"2026-08-11T13:00:48.048477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.052035Z","title":", Chang , Y.-J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.052035Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:a1e504339f702857a04db975f8be83c1512e135441b3056995e63596b9c9ee66","observation_id":"50530d7c-3c1a-413d-963d-059639fcbfc4","resolution":{"observed_at":"2026-08-11T13:00:48.052035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.055434Z","title":", Kerenidis , I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.055434Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:b51eb3026c64d1725910ae24638decea6b7fb514c911887dee26a2edd0bc764d","observation_id":"0eb38cbc-3f45-4e01-ab05-07ab39c961c5","resolution":{"observed_at":"2026-08-11T13:00:48.055434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.059130Z","title":", Buffoni , L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.059130Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:e770588721240d55b0e250945bb993610b3c134fc98ec880640ffe0e5a7a1712","observation_id":"b7e6c3ae-3331-41cd-8338-b2bdb77c0a45","resolution":{"observed_at":"2026-08-11T13:00:48.059130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.062702Z","title":", Chen , C","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.062702Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:850b070aaed2235a678908fe8f7b3aaff66b32f28a7ef4dd7eb8fd9ffb347d59","observation_id":"fabb121c-04a6-4524-9391-1552542a8e36","resolution":{"observed_at":"2026-08-11T13:00:48.062702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.066150Z","title":", Taylor , J.M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.066150Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:72858798bfa5f5605447f4f4538fa1e481a9518f3dc52d449e70868b655bc9eb","observation_id":"c3a2d5d8-2003-4599-a6af-762c782373f2","resolution":{"observed_at":"2026-08-11T13:00:48.066150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.069727Z","title":", Tighineanu , P","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.069727Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:ef8137aefd8c57c52c99f5a9a9513cfabc8f8e5707da64f4f78ef68cda5fe63b","observation_id":"258cd0f7-b634-49a9-a635-34b16af8f637","resolution":{"observed_at":"2026-08-11T13:00:48.069727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.07585","last_updated":"2021-03-13T00:49:51Z","snapshot_observed_at":"2026-08-10T18:50:33.531348Z","submitted_at":"2021-03-13T00:49:51Z","title":"Quantum circuit optimization with deep reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.07585","snapshot_observed_at":"2026-08-11T13:00:48.073093Z","title":", Niu , M.Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.073093Z"},"links":{"cited_paper":"/paper/2103.07585","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:9f371cc835068febfa34672deacf985284b0ecfabbc0759c35d999e04e4f82c6","observation_id":"d75558d8-7153-4487-b8b2-686bb7854224","resolution":{"observed_at":"2026-08-11T13:00:48.073093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08617","last_updated":"2023-02-16T23:01:27Z","snapshot_observed_at":"2026-08-13T12:43:03.085035Z","submitted_at":"2023-02-16T23:01:27Z","title":"Quantum Computing Provides Exponential Regret Improvement in Episodic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08617","snapshot_observed_at":"2026-08-11T13:00:48.077453Z","title":", Wu , Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.077453Z"},"links":{"cited_paper":"/paper/2302.08617","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:653e380ab43fa0305a3cd3c5ea1572b8dcbd5dd8fc54d16ed3922cd0693a69e5","observation_id":"dfb37536-634e-45be-a78b-c7d66b104fc3","resolution":{"observed_at":"2026-08-11T13:00:48.077453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.081391Z","title":": Quantum mechanics helps in searching for a needle in a haystack","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.081391Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:def9f76d16f1a2f5ddbdb997900181ec5e668000ae92fbdfb9fd8e9c079139c5","observation_id":"f4710dd9-4d36-49de-a09f-4654e69794d4","resolution":{"observed_at":"2026-08-11T13:00:48.081391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physreva.110.012605","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.477244Z","title":", Susto , G.A","venue":null,"work_id":"a86fb869-ff12-418b-adfb-27a45d8b3e4b","year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.084998Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:c6710b044d5990c6e16adc0a96c2bf6c27383fc09d24eb85dacc4f103db9d0f0","observation_id":"53d35691-fa37-45c1-a074-6ddd50dba7dc","resolution":{"observed_at":"2026-08-11T13:00:48.482099Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.088442Z","title":", Dunjko , V","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.088442Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:41c58a73ced1ad814ca666b2173c8fc418dd472bf9034840989145142332a7a3","observation_id":"73c555a2-cac8-46ca-9fc7-3e19f3890787","resolution":{"observed_at":"2026-08-11T13:00:48.088442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.092094Z","title":", W \\\"o lk , S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.092094Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:36da55719378bb3f7628da96e22128155ccc82acd4aca091cabd521adaa9ad28","observation_id":"9c1530b0-92dc-4b42-bb68-b2f5b2666320","resolution":{"observed_at":"2026-08-11T13:00:48.092094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.095776Z","title":", Heimann , D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.095776Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:cd68d8cba63b93b6bba1df9da72458382cf701dcd58533d9d6a904420a45af2a","observation_id":"5161c002-1a5c-457c-b0a8-d5563e463651","resolution":{"observed_at":"2026-08-11T13:00:48.095776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.099287Z","title":", Patil , P","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.099287Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:a03562b503c00d663b6d12ee6d5e0ef76f129a7873a9b69dcc09ecca66ac7737","observation_id":"dcd8558d-2fbf-46f5-a626-28c7124ec5fc","resolution":{"observed_at":"2026-08-11T13:00:48.099287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:49.081414Z","title":", Gyurik , C","venue":null,"work_id":"c252c9a3-6a39-4703-8dc7-b4bca121eeaf","year":2021},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.102851Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:7f8eac7589171b704e729e0ccf86de38450c0b06c15ad9b4cce842b9f9d1d102","observation_id":"579f0a2f-7aaa-43a2-abef-89ea74210b75","resolution":{"observed_at":"2026-08-11T13:00:49.085086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"quant-ph/9511026","last_updated":"1995-11-20T20:39:33Z","snapshot_observed_at":"2026-07-07T07:25:58.693900Z","submitted_at":"1995-11-20T20:39:33Z","title":"Quantum measurements and the Abelian Stabilizer Problem","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"quant-ph/9511026","snapshot_observed_at":"2026-08-11T13:00:48.106531Z","title":": Quantum measurements and the Abelian Stabilizer Problem (1995)","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.106531Z"},"links":{"cited_paper":"/paper/quant-ph/9511026","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:109112979ee73d73c57cdacd6c47ff3b58b338da5db43674dcf251444f34156a","observation_id":"c9ee973f-522f-4c1f-a3f1-71159c94409e","resolution":{"observed_at":"2026-08-11T13:00:48.106531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-13T22:24:37.672685Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-11T13:00:48.110347Z","title":", Towers , M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.110347Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:7256ba551cc473b2f372e65327bade593e6bf02083df5526ef16fb09d8cd0eb1","observation_id":"97702f5f-586e-4a32-895a-0231acae2fc0","resolution":{"observed_at":"2026-08-11T13:00:48.110347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-11T13:00:48.114233Z","title":", Hunt , J.J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.114233Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:95d5c075164be46d76ff6686f525e1c781dbf0b3be3a0d1a0df9e30c319411d4","observation_id":"43521604-3d37-4250-8994-b02d4beb1f70","resolution":{"observed_at":"2026-08-11T13:00:48.114233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.03188","last_updated":"2022-05-14T19:20:50Z","snapshot_observed_at":"2026-07-06T11:45:18.755450Z","submitted_at":"2021-09-07T16:48:39Z","title":"Optimizing Quantum Variational Circuits with Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2109.03188","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.03188","snapshot_observed_at":"2026-08-11T13:00:48.703793Z","title":"Optimizing Quantum Variational Circuits with Deep Reinforcement Learning","venue":"cs.LG","work_id":"6d60bda2-6ce5-43fc-a85a-5117e9203f9f","year":2021},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.117751Z"},"links":{"cited_paper":"/paper/2109.03188","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:0602ff475c642ff860da1a4cd1185fcd88db689ed38f365ea22dbe6ba0b0b102","observation_id":"c50d49ea-50d4-4a85-9d38-5a857122a0b2","resolution":{"observed_at":"2026-08-11T13:00:48.709699Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.121481Z","title":", Si , M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.121481Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:db18cd55e5537dd3ac44b128bf276217660ef4ad9c06b17c1dbd0352efc58a36","observation_id":"76b6f135-2b23-4ad2-a57e-cde375f84a47","resolution":{"observed_at":"2026-08-11T13:00:48.121481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:49.069945Z","title":", Si , M","venue":null,"work_id":"d5d84c58-6fa2-4eb6-9718-7566a1eca969","year":2020},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.125024Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:274d828ac11771f7be0f7dedd20d7564bfb44069ca07191693e59ab6319d8f1d","observation_id":"a4f67d8b-2daa-4a63-8949-370bd1120c25","resolution":{"observed_at":"2026-08-11T13:00:49.073919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.128601Z","title":", Kavukcuoglu , K","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.128601Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:0bb414f44afae08794b11092d286f8f5a046875353858036a87c5bb74400a1be","observation_id":"2b13e458-29fe-466c-8d5c-d452284113b3","resolution":{"observed_at":"2026-08-11T13:00:48.128601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.132192Z","title":", Delfosse , N","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.132192Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:030f416c68954f1b58416ac5904732851055322f3b39dcdc59d99a45d1eddb53","observation_id":"410fcfe5-97ec-474c-8a6e-de7f05615147","resolution":{"observed_at":"2026-08-11T13:00:48.132192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.135973Z","title":", Chuang , I.L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.135973Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:0448fe9cd9816d7f8826143fbe4538a7359b41cdc3bb09e17d1e3dc2400389ed","observation_id":"cff642a1-f00b-43ce-a793-6d186470a24e","resolution":{"observed_at":"2026-08-11T13:00:48.135973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.139457Z","title":": A practical introduction to tensor networks: Matrix product states and projected entangled pair states","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.139457Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:4fb0eadaea14910194debbe3b8f80f185a0d490d2a0df0db0ffc0071e37e87a9","observation_id":"37e65745-bb36-4cb4-844d-c07a15324d76","resolution":{"observed_at":"2026-08-11T13:00:48.139457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"hash/9724412","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.687314Z","title":", Trenkwalder , L.M","venue":null,"work_id":"c6719f8d-7a6c-4db2-ba77-400d7cf58674","year":2021},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.142951Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:c3dbb6ddd873f1b691c7c75adb27b0830f551422f2ae1f3b62e7968a5545fe61","observation_id":"7d93b9d1-be5e-48d9-b41f-eebf7afad109","resolution":{"observed_at":"2026-08-11T13:00:48.692994Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.146162Z","title":", Dunjko , V","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.146162Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:e5825f3550a461e7f04fc6bdddd881558ff281478d68fd37c9d723258e96edce","observation_id":"871903cb-7275-4377-be23-537774a307dd","resolution":{"observed_at":"2026-08-11T13:00:48.146162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.149667Z","title":": \\\"U ber eine A ufgabe der W ahrscheinlichkeitsrechnung betreffend die I rrfahrt im S tra ennetz","venue":null,"work_id":null,"year":1921},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.149667Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:99853d7bce4c82385ed1fe03af5bb2d3f9175ebd381d9a0b219b8f642995def1","observation_id":"30dbc203-fe45-4a2a-b4c4-02149844293f","resolution":{"observed_at":"2026-08-11T13:00:48.149667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.153224Z","title":": Quantum C omputing in the NISQ era and beyond","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.153224Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:4a3ca27c77e142e0bd3ef5ae181f210a2dea128ee5296cf14a2bc4143df9aee7","observation_id":"daaff8a7-6bdc-46a0-8b58-613ad8b800dd","resolution":{"observed_at":"2026-08-11T13:00:48.153224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02717","last_updated":"2024-08-05T13:02:26Z","snapshot_observed_at":"2026-08-12T23:50:11.353933Z","submitted_at":"2024-06-04T19:00:42Z","title":"Reinforcement learning-based architecture search for quantum machine learning","version":3},"cited_work":{"arxiv_id":"2406.02717","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.02717","snapshot_observed_at":"2026-08-11T13:00:48.617518Z","title":"Reinforcement learning-based architecture search for quantum machine learning","venue":"quant-ph","work_id":"29040bb4-9019-45f1-8006-e4ecf8a73807","year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.156733Z"},"links":{"cited_paper":"/paper/2406.02717","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:c51aed933f9f000d7812665a4725c46affbe6eca656ec4dbb9e0b00dab14039a","observation_id":"423c88c7-d3f1-4eaf-ba8f-72e2fcc55d0f","resolution":{"observed_at":"2026-08-11T13:00:48.622833Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14396","last_updated":"2024-03-05T13:39:58Z","snapshot_observed_at":"2026-08-13T04:13:04.137317Z","submitted_at":"2024-02-22T09:20:54Z","title":"Quantum Circuit Optimization with AlphaTensor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14396","snapshot_observed_at":"2026-08-11T13:00:48.160263Z","title":", Laakkonen , T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.160263Z"},"links":{"cited_paper":"/paper/2402.14396","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:dd88d62a0368a0260074fd43679a66902382f45b735b88be1e9861b15e56043e","observation_id":"890e3c00-13ad-47c5-abae-ee4aab43a505","resolution":{"observed_at":"2026-08-11T13:00:48.160263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.164999Z","title":"o mberg , T. , Schiansky , P. , Dunjko , V. , Friis , N. , Harris , N.C. , Hochberg , M. , Englund , D. , W \\","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.164999Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:116e33fb88455d511a89adb3b6c372787fbd712c8d6b3249bfb961b4d49e8049","observation_id":"7196a248-1b7f-4943-8860-c150e0ec77e1","resolution":{"observed_at":"2026-08-11T13:00:48.164999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.168526Z","title":", Killoran , N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.168526Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:8fa7ab622f9703fc2a27835e81d6dd60bec04c32cc1a17cb2289cda0f7eb2387","observation_id":"7783729a-3942-4d21-8f68-0b1739959027","resolution":{"observed_at":"2026-08-11T13:00:48.168526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-11T13:00:48.172194Z","title":", Wolski , F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.172194Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:5c1749bdd08e46b84f7fdb5ed1a594a2a069ae8fbdb79d77f1d998965b2e6719","observation_id":"b39dcf33-320d-4778-ba80-75008d92aa2d","resolution":{"observed_at":"2026-08-11T13:00:48.172194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:49.058313Z","title":", Lever , G","venue":null,"work_id":"34d46b72-5a3c-428e-b855-5e38fa858304","year":2014},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.175693Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:de037f09eeea3fe3b39b78c095ff460df06e0eaca1b654a0466e1a93b6274ad0","observation_id":"6771f0dd-8e03-42e8-8bd2-f6702e0efce3","resolution":{"observed_at":"2026-08-11T13:00:49.062032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.179169Z","title":", Schrittwieser , J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.179169Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:989ee5ce02fb601d5d91698d33df17155c50d0c382c84eb7e1115bfc4ddf7b55","observation_id":"8c5e4e6d-612a-4e3f-863d-070755f5dfb0","resolution":{"observed_at":"2026-08-11T13:00:48.179169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.182526Z","title":", Eickbusch , A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.182526Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:5c59f2863f92d9ee8500a0eabf7b60ffb15821887a280828442b27965f36aecd","observation_id":"78d4840f-7db2-44b3-a5e4-0ff4f82e2c85","resolution":{"observed_at":"2026-08-11T13:00:48.182526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.185974Z","title":", Eickbusch , A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.185974Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:f958265571d16099f9ad355a1d665b65f0ce4121008a7df50b030e648ed30399","observation_id":"325f5eea-602a-4701-9be4-5e1f32bba401","resolution":{"observed_at":"2026-08-11T13:00:48.185974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.189356Z","title":", Jerbi , S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.189356Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:c0879a4b85817a3f14afe5b06f9b9ce26f1edfbdba207e38a0cd690423f9f878","observation_id":"c4b4a5b4-3b3a-4ec5-a9e8-d829f3ebcbdb","resolution":{"observed_at":"2026-08-11T13:00:48.189356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.304315Z","title":", W \\\"o lk , S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.304315Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:a1d1855fbc543d74c4f11f343b5e98ca67bd695fb131e0f91f8e3399cd2aff36","observation_id":"a9a0b408-ef09-424d-979e-928278dfc759","resolution":{"observed_at":"2026-08-11T13:00:48.304315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:49.047246Z","title":", Barto , A.G","venue":null,"work_id":"fc3ff19c-32b0-4a0a-8bff-147b506957d9","year":2018},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.308417Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:2db55a801cfd7eb0451c5ca34517b09e21e0a53b9df5214bf5d7ea485bc73cf7","observation_id":"305d731a-f773-4f2c-8c1a-31f0593eb8ca","resolution":{"observed_at":"2026-08-11T13:00:49.051082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.311994Z","title":", Dayan , P","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.311994Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:921af1ba26baa377f47a6370b2afd8a9f9c68a287c9d907dd6989c2c0c1f405d","observation_id":"2b060582-5f6c-4875-a3a8-aa0420e5424a","resolution":{"observed_at":"2026-08-11T13:00:48.311994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04741","last_updated":"2023-05-10T08:36:41Z","snapshot_observed_at":"2026-08-13T15:27:04.699066Z","submitted_at":"2022-06-09T19:23:10Z","title":"Quantum Policy Iteration via Amplitude Estimation and Grover Search -- Towards Quantum Advantage for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04741","snapshot_observed_at":"2026-08-11T13:00:48.315637Z","title":", Hein , D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.315637Z"},"links":{"cited_paper":"/paper/2206.04741","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:c9b934f4316f93c0832d4d8737d5811ea5497da22d8002ab58f6eb035bf13770","observation_id":"8bf81549-16ca-4097-a78f-a46ed3eb472d","resolution":{"observed_at":"2026-08-11T13:00:48.315637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10796","last_updated":"2024-06-13T17:00:41Z","snapshot_observed_at":"2026-08-13T12:40:05.442688Z","submitted_at":"2023-02-21T16:23:11Z","title":"Provably Efficient Exploration in Quantum Reinforcement Learning with Logarithmic Worst-Case Regret","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10796","snapshot_observed_at":"2026-08-11T13:00:48.319254Z","title":", Hu , J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.319254Z"},"links":{"cited_paper":"/paper/2302.10796","citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:4a347a866fd9a79fb1661e0f19946a89c424a826b1eca15866810d77e963b945","observation_id":"4cd42b0a-76ca-420f-a4d9-be2c9034e202","resolution":{"observed_at":"2026-08-11T13:00:48.319254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:00:48.322823Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T13:00:48.322823Z"},"links":{"citing_paper":"/paper/2412.13686"},"observation_digest":"sha256:eeae01068e2f777ff988b7548a68e60d20435dac13952ec8f27ec351375a7f74","observation_id":"35969ca7-31ec-47e5-997a-cd641199c557","resolution":{"observed_at":"2026-08-11T13:00:48.322823Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13686","last_updated":"2024-12-18T10:23:46Z","latest_version":1,"primary_category":"quant-ph","snapshot_observed_at":"2026-08-14T14:57:46.389120Z","submitted_at":"2024-12-18T10:23:46Z","title":"A hybrid learning agent for episodic learning tasks with unknown target distance"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":4,"verified_fuzzy":4},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2412.13686."}