{"as_of":"2026-08-07T07:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5e66c531f209b023db5b91bd1e4a871d53bb07a8ea4670b5abcd6aaf024f06dd","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T00:23:41.373753Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.00275/citation-record","integrity":"/paper/2507.00275/integrity","json":"/paper/2507.00275/citation-record.json","paper":"/paper/2507.00275"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agarwal, D","venue":null,"work_id":"7594cb91-beda-443a-a5d6-e40230adae2e","year":2020},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:6c629856ac54556087b0cc58dfad275dad6ef1a8dc7ece8fbe60554658a68dc2","observation_id":"4e91adc7-b284-4a0b-ac3f-de46aa64e6cf","resolution":{"observed_at":"2026-05-22T00:24:28.084227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agarwal, M","venue":null,"work_id":"ec80653c-e3ec-43ab-875c-e243206a343a","year":2021},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:f993b2ee6c2fbcae5a9b0a46df5ea1e0ffec2c3293b69496e801b3416dbfaf04","observation_id":"736b287f-79a6-420d-b79b-6e16a82d8ea6","resolution":{"observed_at":"2026-05-22T00:24:28.091439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aitchison, P","venue":null,"work_id":"abddbe44-a9ee-49d7-8ef8-23b1e17ba424","year":2023},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:a47d555d81dc79ea363abdea592207162527dd5273807fa023ae6295fd24c3c7","observation_id":"afdf2e41-3390-4674-97ad-c5ae074fd775","resolution":{"observed_at":"2026-05-22T00:24:28.088850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anschel, N","venue":null,"work_id":"4fe6716b-226e-40a6-83b1-2a6fd100d278","year":2017},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:198f76f158326fff061e9438e6856179badbd4936a50c6e23bbd57a5ae2f8290","observation_id":"3aa1b928-7215-4a4b-9215-8f4893045be8","resolution":{"observed_at":"2026-05-22T00:24:28.085566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9cd9ec65-3b4f-4e8d-aeb6-64da5d641300","year":2013},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:d304aa3652c61317e84406dc81e03273191f4fa5f5aaf8d2961248574961a1ef","observation_id":"65a31bdf-06fc-40a5-bbd2-57cbc90247d5","resolution":{"observed_at":"2026-05-22T00:24:28.082614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ac3a3a8f-c1f8-48d7-8a10-494ee829969f","year":2017},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:dfec8cb8023f24d1bc324d399dedaf1a4e0edcac09dac4fca89e966a8deec689","observation_id":"377cca0e-e676-4504-84f8-edc64a0b3f3a","resolution":{"observed_at":"2026-05-22T00:24:28.025246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.06956","last_updated":"2020-06-12T05:59:05Z","snapshot_observed_at":"2026-07-06T09:28:22.395832Z","submitted_at":"2020-06-12T05:59:05Z","title":"Decorrelated Double Q-learning","version":1},"cited_work":{"arxiv_id":"2006.06956","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.06956","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8c123e44-d5aa-4ca3-b1f5-4c2b8476ad2a","year":2006},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"cited_paper":"/paper/2006.06956","citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:c06df5c55f007da75239ae6f833b77e52236f8fac3f7ee7f49373341e41eb450","observation_id":"1ed63827-9f9c-431c-b4b8-27cd2cadb1d2","resolution":{"observed_at":"2026-05-22T00:24:27.681010Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"332e8a8c-d6f5-49e9-b404-3270283ec5c6","year":2021},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:6c7823865d343a0d69eed072c3434f7e9d667d22314a8329a49a474547a45e67","observation_id":"ca68f8fc-a8b3-48e2-a832-8570056e5160","resolution":{"observed_at":"2026-05-22T00:24:28.079264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Farebrother, J","venue":null,"work_id":"2eab6ee6-483d-4e9e-bd7b-900a42f8bb21","year":2024},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:b5db06f8d4bb1165163d4b353eb2c4d1bc20d0987dbe937ca3ac305efa3f447b","observation_id":"e86a3cda-0f4e-4260-a6d8-c780706deec9","resolution":{"observed_at":"2026-05-22T00:24:28.076350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fedus, P","venue":null,"work_id":"63cf74f1-c18d-4812-8455-3586a6b5c954","year":2020},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:8b0a419d779db959d037dd3a3d668fc14b10698e32f5fdaa8295043cfdd45e76","observation_id":"6d5dbb14-ca24-46b0-bf14-5bf5392e5722","resolution":{"observed_at":"2026-05-22T00:24:28.088194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fujimoto, H","venue":null,"work_id":"b04918ee-89a0-4988-bce8-a05d10ddc0cb","year":2018},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:d86fddbeb1cacaed0b7ad58f69c4640374db3973f98a0c4c61e2d3b1d0e5791f","observation_id":"83966fe0-8981-4a8d-bcd9-5c98a78612c1","resolution":{"observed_at":"2026-05-22T00:24:28.074372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fujita, P","venue":null,"work_id":"95aa0e95-0c09-4146-89a0-9fb2905ac0b6","year":2021},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:620f0df19e813b1fb435459755ff001ab1186ed2a4d1808264525155e602f5ef","observation_id":"baae0b8d-08d2-48a4-893c-0874b75d783d","resolution":{"observed_at":"2026-05-22T00:24:28.071628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":"1812.05905","doi":"10.48550/arxiv.1812.05905","metadata_source":"pith","pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Soft Actor-Critic Algorithms and Applications","venue":"cs.LG","work_id":"bb49c9fb-03b2-4226-9edb-50186b8193e4","year":2018},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:c9bc484f8884c7df497befe838db563402ac30c09a4a2324618d9c5bee66867b","observation_id":"514b3a63-17a3-4436-9091-30655c9af17b","resolution":{"observed_at":"2026-05-22T00:24:27.690993Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T09:49:21.584701+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T09:49:21.584701+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hessel, J","venue":null,"work_id":"cb1d97af-9b86-4a8e-9d33-7239f32bc3f4","year":2018},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:7313f3709fe2f40d8e54028719c25079234d1e4caa24df36c3c5fc767c4a406c","observation_id":"212d02af-3196-4b47-8ce3-86ce16283fd2","resolution":{"observed_at":"2026-05-22T00:24:28.098414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"952b29ac-3892-421e-b58b-ec4976921edf","year":1994},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:ac61937b8b956d63e60b6cf4fe12d9e42bd9e63d7a8daa8e6d88aabc09543514","observation_id":"949c313a-e411-4a6e-b869-9ae83e96fc3b","resolution":{"observed_at":"2026-05-22T00:24:28.069027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"81991caa-360c-49c2-a67a-271ad91ad12f","year":2020},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:d7fc7a10c3b8e740179079cb1531348b30165f2059c894396a411e64505e9c03","observation_id":"82dce882-760c-491b-8921-32fd0babb4bb","resolution":{"observed_at":"2026-05-22T00:24:28.079534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LeCun, Y","venue":null,"work_id":"ea9c4d4b-7f48-48ba-9d3a-fa31fb5ef03d","year":2015},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:6584a125068613cde371fd00618f2bbccf01eb19f483fe5734b749ca35a5c803","observation_id":"03199cc6-1cd4-44ca-8d76-4bdfc7ec39e9","resolution":{"observed_at":"2026-05-22T00:24:28.005477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1300524c-8cdf-4e28-b5c5-3d7b8b0df61b","year":1991},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:d00643b464ef705db745e43cdf1f2fec82483b30229d4e503cce1cd2790d2996","observation_id":"44df100c-2479-41c5-aa4d-8d1b48f2ecb0","resolution":{"observed_at":"2026-05-22T00:24:28.049787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7caa2b49-7516-42a8-82f5-2df87934e35f","year":1992},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:6bc9b1a7cadc05aa5834736c6b516cf259c9e644294fd6cb2ad9743e4982cd54","observation_id":"10e53ae0-37e8-48c7-abbd-92f4237d043e","resolution":{"observed_at":"2026-05-22T00:24:28.066568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dfe8a258-90de-45bc-8ae4-0c94c13600e7","year":2018},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:f156cc3e0493a350295f94f8f0859658e75fc50bb4bf982ed9fe4999f918e823","observation_id":"cafb252b-ba7b-4d34-86d9-d39c02a49e80","resolution":{"observed_at":"2026-05-22T00:24:28.070272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"57a8f9b3-f478-439a-a5ef-50780b249431","year":2015},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:9903073725fea912b1ca0180e10be34fcdc20d0a2062d4e1671f11f3d868d27d","observation_id":"ce603ab6-4699-4c62-bdd3-194b67ed9da8","resolution":{"observed_at":"2026-05-22T00:24:28.056865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"77224725-63eb-4741-977d-22ccddcd8960","year":2021},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:0e354219e0c8072d5fa60273a02f5e81c678d3380642b5bffad67e2ae6707569","observation_id":"c7fff90c-fe27-46cf-bb50-f91315617345","resolution":{"observed_at":"2026-05-22T00:24:28.002841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Osband, C","venue":null,"work_id":"a040f1af-f9e3-45b2-b2db-f54b8c0dd525","year":2016},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:a97b0fe1c0d8e7089616570d53e7489a6d3f8be7f1a3ac8cd38070c329f707c0","observation_id":"aa0017e4-5f27-40c9-9d62-e959e25d4d9f","resolution":{"observed_at":"2026-05-22T00:24:28.059921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ostrovski, P","venue":null,"work_id":"7578e34b-faaf-44e8-bfe0-5be69440d4f8","year":2021},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:bfc581ae6703a5d6d2a325406d7e06e1c20b2b3c417b3a80f8c704eb4cfea03a","observation_id":"bd929488-6f2c-4556-b27e-c9e9dd0e6d37","resolution":{"observed_at":"2026-05-22T00:24:28.082246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Patterson, S","venue":null,"work_id":"ec77e772-4c0f-42f0-b45e-ac026bd6da3e","year":2024},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:1661f3f1aaaeae57c55e1e1b064ca30f49f5ed30345896e21cf48a75f13f4441","observation_id":"12de7bf6-a522-4015-9584-d7fa4dc86722","resolution":{"observed_at":"2026-05-22T00:24:28.018796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"948f8550-8641-4c3c-9f3c-7d4a6068e9fe","year":2021},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:b3205aebc93add18c76d23e73a5f3d717c5c8c31ab09a080fb1909c9500e0ff4","observation_id":"b88115d4-4d30-4127-a70e-90f5d04fe4a1","resolution":{"observed_at":"2026-05-22T00:24:28.060180Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quan and G","venue":null,"work_id":"f039c0d7-b50b-4c9b-bbf4-af5a366b0be5","year":2020},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:0bfcabd4bbaae4e923ac4d7b74f57a3d6b26a425652385f586ca27108e64d61a","observation_id":"da592eed-e7bd-4608-94c8-c3a9a5efc457","resolution":{"observed_at":"2026-05-22T00:24:28.062644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schaul, J","venue":null,"work_id":"425b94eb-372e-4cde-81de-d4049613d92f","year":2016},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:b8fe511633e54d516d96d87d1cb1a900341c3e24513a1f8f38df2ad4783940a4","observation_id":"cfe5b3a6-93c3-437e-a9b4-e0177fdb7e04","resolution":{"observed_at":"2026-05-22T00:24:28.054885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schaul, A","venue":null,"work_id":"a6ed4dd6-660f-4c7c-9810-cb871b46a484","year":2022},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:091c622e4166ba700160de25948b47ae894aefbbaf07c511b288e85edd5fb3f3","observation_id":"b4867633-9ef2-409f-bb65-08dd4d395322","resolution":{"observed_at":"2026-05-22T00:24:28.042624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d35f74e5-ffc8-47c4-bbad-6dcecff42f33","year":2006},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:bac2b809d845bfc9069754b1fdfa1eb9f972d520b81da81303cd78b6b3b55138","observation_id":"709ec890-edef-48d2-aed0-89c70867a869","resolution":{"observed_at":"2026-05-22T00:24:28.032883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"540e828d-ae2a-4348-944f-b37a859e20dc","year":1988},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:304053f62ca5e1e622f2cee9b8bd6e7a0b9ce18ae4bf3370f2c7b27c45a58c88","observation_id":"88f18e66-5517-4866-b2ed-7bf9059c7705","resolution":{"observed_at":"2026-05-22T00:24:28.000071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dc87bc7b-faa1-477f-878f-fd225e5df677","year":2018},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:f25d9e8f6285eea0047d94612c064b1c59920f8631d32678f9973d8a49d59f92","observation_id":"3f805786-f03e-4912-b7e9-8466f970cca5","resolution":{"observed_at":"2026-05-22T00:24:28.052045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Thrun and A","venue":null,"work_id":"58a412d7-dafb-4df2-ae80-dd3d7cfc18a7","year":1993},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:a6c35f49fc8b43634f97bb5ec8772c0dc318a1762d58b6bac9423af1ed04aa67","observation_id":"99b043ce-9104-466f-9597-f19b18daa40a","resolution":{"observed_at":"2026-05-22T00:24:28.073861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tieleman","venue":null,"work_id":"f10748e7-ce65-4ff2-bf23-13f99d311249","year":2012},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:75fc73f44e0cb1b99bf9543ca9ab1d98517be4667955b4fc6b80961a58333e82","observation_id":"ef752c85-a950-46ca-bd94-94a8cbd1dfa1","resolution":{"observed_at":"2026-05-22T00:24:28.024471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":"2407.17032","doi":"10.48550/arxiv.2407.17032","metadata_source":"pith","pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","venue":"cs.LG","work_id":"5382dc1c-a327-49b9-afda-4794d5847698","year":2024},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:932c696818157cf1d669120efdcfb2fb72824d32e306470a55145cad708dd0fa","observation_id":"a59e7710-90a6-467e-bbb0-bb781937730f","resolution":{"observed_at":"2026-05-22T00:24:27.686506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-13T20:21:08.751241+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T20:21:08.751241+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"van Hasselt","venue":null,"work_id":"696094ca-6209-462c-adf2-cabdb060a726","year":2010},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:67a44550d6cd24c8caf41fd926eea43a3880727a0802efc762443aac2626eca7","observation_id":"3cd13d70-7522-4b06-b4f4-fe5cfc03af75","resolution":{"observed_at":"2026-05-22T00:24:28.053202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"van Hasselt, A","venue":null,"work_id":"4f8b4e5f-763e-451b-b997-44ed138ddff1","year":2016},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:3645ca6d7c2b642a5898f128ef436629b376bd579b6deaf2aac4f78c3b301453","observation_id":"b30c7fbf-db00-4e73-bca5-c37f331b407f","resolution":{"observed_at":"2026-05-22T00:24:28.019448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02648","last_updated":"2018-12-06T16:36:20Z","snapshot_observed_at":"2026-07-06T07:19:38.028327Z","submitted_at":"2018-12-06T16:36:20Z","title":"Deep Reinforcement Learning and the Deadly Triad","version":1},"cited_work":{"arxiv_id":"1812.02648","doi":"10.48550/arxiv.1812.02648","metadata_source":"pith","pith_arxiv_id":"1812.02648","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deep Reinforcement Learning and the Deadly Triad","venue":"cs.AI","work_id":"de214ead-4cb0-4abd-be3d-ae3389f55e9b","year":2018},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"cited_paper":"/paper/1812.02648","citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:0f763a13ca9197be3fa31054ec7c8210e0805e289841d785523a7f5088688cae","observation_id":"5b2d7d2a-e700-4553-b7bb-4aa42a49be90","resolution":{"observed_at":"2026-05-22T00:24:27.676010Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"van Hasselt, M","venue":null,"work_id":"772a666f-3f30-4277-aa58-72e261fb44ac","year":2019},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:312632a14dbe65976ad7df535f0ad2488450852c4a2be39fb9562c5e9b010ee1","observation_id":"f828220a-d9ee-4d70-99f3-1a4fbc027b77","resolution":{"observed_at":"2026-05-22T00:24:28.062887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05262","last_updated":"2022-10-11T08:46:05Z","snapshot_observed_at":"2026-08-04T17:44:08.538537Z","submitted_at":"2022-10-11T08:46:05Z","title":"Factors of Influence of the Overestimation Bias of Q-Learning","version":1},"cited_work":{"arxiv_id":"2210.05262","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.05262","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wagenbach and M","venue":null,"work_id":"d83c5941-abbb-495f-a1dd-b06e444ff474","year":2022},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"cited_paper":"/paper/2210.05262","citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:d36c94f3e3c7c15b57208f9be26b0885023327835fcf8c5811783b3ed7442b73","observation_id":"9eb0f58c-61ea-4d4d-9977-b9217b80f1a1","resolution":{"observed_at":"2026-05-22T00:24:27.662494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Waltz and O","venue":null,"work_id":"21045b89-8ad4-4234-8563-54037bbdafc9","year":2024},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:c9ed90bcc4e603278d7579f75871fbeafe7c45d90e191a61e38d90cc6ed0d43b","observation_id":"6c3d137d-9c99-4de7-b16f-3de7adb55b59","resolution":{"observed_at":"2026-05-22T00:24:28.043819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13780","last_updated":"2020-09-29T04:58:17Z","snapshot_observed_at":"2026-07-06T09:59:41.727913Z","submitted_at":"2020-09-29T04:58:17Z","title":"Cross Learning in Deep Q-Networks","version":1},"cited_work":{"arxiv_id":"2009.13780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2009.13780","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wang and A","venue":null,"work_id":"a5f5beae-c52b-45e7-9b91-c8327c00ed83","year":2009},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"cited_paper":"/paper/2009.13780","citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:990aeb1579cbc09a8a3d6d17f9c70b9348558debba44d0b613b5f537bc07a8c5","observation_id":"1577c4df-84c3-4e28-b08c-c20ce22cb02f","resolution":{"observed_at":"2026-05-22T00:24:27.670964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d66f0445-0361-4fd5-becb-1d9af7327d8e","year":2016},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:59bf4ec62fb1577f396a6174585ea4b37e3376c3da6dbeb08ec0d09cfbbc0199","observation_id":"eae219d5-bd3f-4f7a-af1b-5fb1865597b3","resolution":{"observed_at":"2026-05-22T00:24:28.028021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dee8da4a-ab23-417b-97d7-1b84e35ca2f2","year":1989},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:2a7c45a266372da0579ef30c189b41dfe7899bc588d7dbab979b74a5699b34e7","observation_id":"f4d3fb18-4ffc-4da8-96b2-afd646e0e6e4","resolution":{"observed_at":"2026-05-22T00:24:28.029904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e7651845-4c8d-47bc-b7ee-d47b215dbb52","year":1992},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:06cfc33beead01fb42274ef1410a43db19e672e444d33274f2f19a48c8dcd47f","observation_id":"0ffaa813-5cf3-48fd-b928-f38c3c7c1821","resolution":{"observed_at":"2026-05-22T00:24:28.094374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhu and M","venue":null,"work_id":"4d1b9396-2147-444e-9e70-1aa061c52720","year":2021},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:0f676f502e4713cfb396df1330c47a88088e91d2bd4e8b830b93ba5e5b7b3732","observation_id":"3757e917-54eb-4516-b73f-b5ac469d27c4","resolution":{"observed_at":"2026-05-22T00:24:28.101210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"write newline","venue":null,"work_id":"4147b9fd-328f-4f97-a318-8adb239afc18","year":null},"citing_paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-22T00:23:41.373753Z"},"links":{"citing_paper":"/paper/2507.00275"},"observation_digest":"sha256:0b66dade887e70a92dc2e4a41d11189541c6ab3a9914d208aeb2e7349787fc7b","observation_id":"730c767a-56bd-439f-8fb4-c0faf8c53034","resolution":{"observed_at":"2026-05-22T00:24:28.097738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.00275","last_updated":"2026-05-14T20:49:30Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T21:50:11.849401Z","submitted_at":"2025-06-30T21:32:46Z","title":"Deep Double Q-learning"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":6,"verified_fuzzy":24},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2507.00275."}