{"as_of":"2026-08-06T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84ce3a1809cca5169bd228de5d8ca8d57a519fea07f5d052a4b76cd5bbe60cf7","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T09:46:29.680687Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20656/citation-record","integrity":"/paper/2607.20656/integrity","json":"/paper/2607.20656/citation-record.json","paper":"/paper/2607.20656"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:25.508320Z","title":"2018 , publisher =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:25.508320Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:c2f645f46a9739847fbd33c09677cf47a80d5704d44a4a5830d2afa1aa45cf69","observation_id":"81d7ccd5-5105-48e9-b1ed-072dc04c0c47","resolution":{"observed_at":"2026-08-01T09:46:25.508320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:25.587667Z","title":"Proceedings of the International Joint Conference on Autonomous Agents and Multiagent Systems (AAMAS) , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:25.587667Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:f04c7239f9061bb066b7dfa167c249854afa79b94f4f600154ece987caebd879","observation_id":"d763517b-085e-4461-9971-67acd2842c14","resolution":{"observed_at":"2026-08-01T09:46:25.587667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:25.664966Z","title":"Neural Computation , volume=","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:25.664966Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:42c456cb822a89d997680d30cd1300618f7dc3d270971c7eea230a86491ee044","observation_id":"c039a206-9423-49a6-accf-db3e842e938c","resolution":{"observed_at":"2026-08-01T09:46:25.664966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:25.737703Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:25.737703Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:f14e67ca97b62ab68846f018aba59f209a1c8e0375879f07f0a0d2807b23322d","observation_id":"5b00d586-a5d0-459b-b772-e2a62185e19f","resolution":{"observed_at":"2026-08-01T09:46:25.737703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:25.847881Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:25.847881Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:526980e42fa7e793ca042ea72e941d43d54a98e0fcdaf7759828170d8b8bf02d","observation_id":"4b9bcaaa-3b76-4490-a5c4-adc75c1c2437","resolution":{"observed_at":"2026-08-01T09:46:25.847881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:25.939706Z","title":"Thirty-ninth Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:25.939706Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:ac65e61481688dcae336f0e65f8f0c400f8074d33b0323fa243cd1a6f8540dd8","observation_id":"1e1f2a90-0687-4184-8d69-4fcac8e77edc","resolution":{"observed_at":"2026-08-01T09:46:25.939706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:26.025343Z","title":"Cruz and Kenway Louie and Daniel C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.025343Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:74045592adec0d7b1d42f217193ad94e34e9d5df77ad013f11ef05eae95fc458","observation_id":"efab948b-9821-4724-83eb-274942ae0cc6","resolution":{"observed_at":"2026-08-01T09:46:26.025343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:26.124271Z","title":"Loss Dynamics of Temporal Difference Reinforcement Learning , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.124271Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:6a80dc4b15cd84f2494302981986e2ea94d8c6406d2bc1e7817eefc3631d399b","observation_id":"e0554593-8666-46e7-9eb4-4e61766e6a20","resolution":{"observed_at":"2026-08-01T09:46:26.124271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:26.217635Z","title":"Nature Neuroscience , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.217635Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:691c829bb37278180e96630354f65f0f6bd065c9c18c2358597f8053ca828fad","observation_id":"ee5e4957-cde8-49c3-97e6-c57cd1c3b38f","resolution":{"observed_at":"2026-08-01T09:46:26.217635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:26.288505Z","title":"Psychological Bulletin , volume=","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.288505Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:d931fcec46ca461984cad9c023be411458d30e42de027eee029546db736fcbfa","observation_id":"4a19c051-cb1f-4808-b7ff-3e21e58df088","resolution":{"observed_at":"2026-08-01T09:46:26.288505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-01T09:46:26.372184Z","title":"Riedmiller , title =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.372184Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:9db89d3ceabbe42159ff5d25de28a045c2cac2280e81484870e1ce4ab0fbcf3a","observation_id":"ed9c935f-27a9-44bf-8cf7-d6d73a36b3b1","resolution":{"observed_at":"2026-08-01T09:46:26.372184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13746","last_updated":"2023-10-31T00:06:14Z","snapshot_observed_at":"2026-07-31T17:57:44.437235Z","submitted_at":"2022-11-24T18:23:28Z","title":"Melting Pot 2.0","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13746","snapshot_observed_at":"2026-08-01T09:46:26.449773Z","title":"arXiv preprint arXiv:2211.13746 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.449773Z"},"links":{"cited_paper":"/paper/2211.13746","citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:f47e9cf53a6ff7527b74c36423ca8089bd6927cfdee0c373c0708b615427d98f","observation_id":"75c6ec6c-51bf-450b-b418-fa73aa07f207","resolution":{"observed_at":"2026-08-01T09:46:26.449773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:26.560416Z","title":"and Modayil, Joseph and Delp, Michael and Degris, Thomas and Pilarski, Patrick M","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.560416Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:cc4b8815516c8d9bee0fc557afd7e8727e24e6a3739fdfb08e49fcb69c7a5ff0","observation_id":"a34a2e78-69bd-4bdf-bb71-e132e9474fec","resolution":{"observed_at":"2026-08-01T09:46:26.560416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:26.635778Z","title":"Multi-time Models for Temporally Abstract Planning , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.635778Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:ccacbfb17a9380e263ea6fe3b2ba134b296c3298867d151f4d5a8345f6c2587c","observation_id":"a9f2be55-6456-4dd4-a49d-a5e8ec3ef52d","resolution":{"observed_at":"2026-08-01T09:46:26.635778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/b978-1-55860-377-6.50072-4","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sutton , abstract =","venue":"Elsevier eBooks","work_id":"f9abe56d-11ea-461e-9c7a-8630f69f30c3","year":1995},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.739597Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:c1150aba479af8abd3bf114847cc485aab202404403fa0b0f262fb158d9d39ed","observation_id":"4d6b1597-adca-4b81-a2d9-7c8003e4da52","resolution":{"observed_at":"2026-08-01T09:49:10.978597Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:26.850249Z","title":"Psychological Bulletin , volume =","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.850249Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:17c3e152729186548e391cf33e03bbf50fe959e21e485e810a20a98d45c35ec4","observation_id":"f4906fdb-4f0e-43ec-bc47-17befb594382","resolution":{"observed_at":"2026-08-01T09:46:26.850249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1101/2021.10.31.466705","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BioRxiv , year=","venue":"bioRxiv (Cold Spring Harbor Laboratory)","work_id":"51a93af5-6a28-415f-b42b-9ff5ccf0e095","year":2021},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:26.924273Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:2c82b71af064828af622165eba63be06b7d832ef4f4a0dc6cd4053f743b8cd90","observation_id":"f76124a3-495c-4b3d-8114-186f75f7fe20","resolution":{"observed_at":"2026-08-01T09:49:10.447713Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.003696Z","title":"PLoS Computational Biology , volume=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.003696Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:5f10770558688d2fe636c8593f71f031142aab08d73924abb06fe6ce4fcf11e5","observation_id":"5181ada0-68e7-404b-93ce-e599f819fd42","resolution":{"observed_at":"2026-08-01T09:46:27.003696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.131133Z","title":"Proceedings of the Royal Society B: Biological Sciences , volume=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.131133Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:53b6365c5ca7858f0937e62d0b492a1c471b0a61c1854e443129e092baf828e0","observation_id":"1f961a08-7a6c-483b-879e-1f9a3423e25e","resolution":{"observed_at":"2026-08-01T09:46:27.131133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07004","last_updated":"2022-08-15T04:38:06Z","snapshot_observed_at":"2026-07-06T13:41:49.545745Z","submitted_at":"2022-08-15T04:38:06Z","title":"AI for Global Climate Cooperation: Modeling Global Climate Negotiations, Agreements, and Long-Term Cooperation in RICE-N","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07004","snapshot_observed_at":"2026-08-01T09:46:27.241746Z","title":"arXiv preprint arXiv:2208.07004 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.241746Z"},"links":{"cited_paper":"/paper/2208.07004","citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:3fb05570ae2ac32339ad0f7d596c030cee6a79158cb551db7a1531294d81ab4d","observation_id":"3e99c200-5a0f-4687-b67b-949f249dca80","resolution":{"observed_at":"2026-08-01T09:46:27.241746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.350621Z","title":"Journal of Neuroscience , volume=","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.350621Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:5bf74ecb185909513cc94e01306742b1fec18a418af4b2cc26c8bc71757273d7","observation_id":"6957fc7b-299e-4a9d-a901-949d87c2a863","resolution":{"observed_at":"2026-08-01T09:46:27.350621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.446588Z","title":"Journal of Artificial Intelligence Research (JAIR) , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.446588Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:9ebd09db19931c8a13bbd5cd167e6da9557f9d181604d0544c2c6bd01a7a1f4e","observation_id":"dd7bef7c-b19d-4385-afa5-87b8fe699b15","resolution":{"observed_at":"2026-08-01T09:46:27.446588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.543913Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.543913Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:fb0496d11014ca83e54de056a166364242da1ce4ddc4975f75561f09fb00d7ce","observation_id":"e0083620-c02c-4d3e-a6a4-66efab709a4e","resolution":{"observed_at":"2026-08-01T09:46:27.543913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.640777Z","title":"Journal of neurophysiology , volume=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.640777Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:93df9c6ea82bcf6b71d9d5184b51a0f7cef2190c01e18872569545df2c682cb0","observation_id":"e321930e-8642-4144-95c0-fa780c402d5e","resolution":{"observed_at":"2026-08-01T09:46:27.640777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.737546Z","title":"Journal of Risk and Uncertainty , volume =","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.737546Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:3ff15b010cc7047ca29a3d26704c81afd1faade379b91d0eb0fdb8373d38dcde","observation_id":"1f105db4-a1af-48f3-ba9d-5f15d1db35db","resolution":{"observed_at":"2026-08-01T09:46:27.737546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.825427Z","title":"Psychological Bulletin , volume =","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.825427Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:6f6aa8c292e414e540008c13bc2410e102369d7c868a344ab98e60d2b8384a7a","observation_id":"cbfcc2cf-b8cb-4818-9a6c-9685471408cd","resolution":{"observed_at":"2026-08-01T09:46:27.825427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:27.920789Z","title":"Fisher and Steven Perlow and Lisa Sherman , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:27.920789Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:570593b27fdce53d886fcce2d2264fd375764bfce68744993cfed04febcc5dbb","observation_id":"f4a4d630-d627-4f53-ad5d-e282475d6f97","resolution":{"observed_at":"2026-08-01T09:46:27.920789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.026302Z","title":"Mazur , title =","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.026302Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:be7ae9173dd0e82ad9256c86aae0be40df46ce26076a151393756180e89e66ab","observation_id":"6aba76a9-8897-4b67-9283-4eccef4d664f","resolution":{"observed_at":"2026-08-01T09:46:28.026302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.070755Z","title":"Journal of Economic Literature , volume =","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.070755Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:9f5529cc0931a6f3c0be101e236598ae38ca55d2f23f74b3ec0dffbde8e9cf45","observation_id":"4ca1b038-a154-4eef-848e-c5a5979e1ba1","resolution":{"observed_at":"2026-08-01T09:46:28.070755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.133686Z","title":"From reinforcement learning models to psychiatric and neurological disorders , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.133686Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:628d0cf6cf21ce88569a372fa2e2b95cb83bbc9d0e3dca301e1bd3d56bd29d10","observation_id":"39277f59-950c-466b-ad23-732dfc4db9bc","resolution":{"observed_at":"2026-08-01T09:46:28.133686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.216943Z","title":"Nature Neuroscience , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.216943Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:821dc3c9a67827b37c377f59de1b7f9b3e710d6520cb3db9a132b5f9d8e70778","observation_id":"5b533cb7-74e5-4d47-aeff-ad0bf84cb938","resolution":{"observed_at":"2026-08-01T09:46:28.216943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.306674Z","title":", title =","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.306674Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:2328079c113b2a6fa72803d1a528963c71385b53e47e2a3349e1905727712d6c","observation_id":"345cebce-b889-4fe3-9d2d-84220228788b","resolution":{"observed_at":"2026-08-01T09:46:28.306674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.401342Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.401342Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:e512128595e325e75d9fce06f6f6331033e9de41035438c080df16644fe1398f","observation_id":"676d0f88-a6cb-4144-a2f4-4056f23c4b6e","resolution":{"observed_at":"2026-08-01T09:46:28.401342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06865","last_updated":"2019-02-28T18:32:24Z","snapshot_observed_at":"2026-07-06T07:33:58.446265Z","submitted_at":"2019-02-19T02:36:14Z","title":"Hyperbolic Discounting and Learning over Multiple Horizons","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06865","snapshot_observed_at":"2026-08-01T09:46:28.468182Z","title":"and Larochelle, Hugo , title =","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.468182Z"},"links":{"cited_paper":"/paper/1902.06865","citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:0f45b0d31152a08091ca39e6a25ef1d71f35bfb20811723212378f967ae375b8","observation_id":"86a9cb09-970c-4cef-a39d-35499813f109","resolution":{"observed_at":"2026-08-01T09:46:28.468182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.528577Z","title":"and Malik, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.528577Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:f6f4e43957efad99ab9c0bc9db9a719bb99600aaad797499b5c1b7fe9bcb3194","observation_id":"d64c723d-a4dc-4a33-b120-3b37e0b8e974","resolution":{"observed_at":"2026-08-01T09:46:28.528577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.599622Z","title":"Devon and Lanctot, Marc , title =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.599622Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:09b4958c07224554ae666db1c94b8ebfd58d95c18bb0cf0bdcfa7363eefc40e8","observation_id":"6f4c6989-d923-4d45-9c04-bfb3c5400bc4","resolution":{"observed_at":"2026-08-01T09:46:28.599622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.693134Z","title":"Read , title =","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.693134Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:f52e27353ac0c89b05281494012444927db628ec5938c177b37d372670696400","observation_id":"d7f26ec7-5216-479f-94f0-6700c07a7d76","resolution":{"observed_at":"2026-08-01T09:46:28.693134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11046","last_updated":"2023-12-01T13:52:32Z","snapshot_observed_at":"2026-07-06T15:56:34.157958Z","submitted_at":"2023-07-20T17:28:01Z","title":"A Definition of Continual Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.11046","snapshot_observed_at":"2026-08-01T09:46:28.773333Z","title":"arXiv preprint arXiv:2307.11046 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.773333Z"},"links":{"cited_paper":"/paper/2307.11046","citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:7503a7772e7031b2448680f997e127c8a1631842a875f9e708cb47e94ba24711","observation_id":"653fccfe-6c8b-4d2a-a556-d2faa10e6dfc","resolution":{"observed_at":"2026-08-01T09:46:28.773333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02908","last_updated":"2019-07-05T16:14:55Z","snapshot_observed_at":"2026-07-06T08:05:24.076802Z","submitted_at":"2019-07-05T16:14:55Z","title":"On Inductive Biases in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02908","snapshot_observed_at":"2026-08-01T09:46:28.858334Z","title":"arXiv preprint arXiv:1907.02908 , year =","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.858334Z"},"links":{"cited_paper":"/paper/1907.02908","citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:4e03fc963179f408d84887e3a3ad0de157ba12de16d4984fd41bb4613dc51f22","observation_id":"8a8f60af-3edc-481a-9aff-bb308b0912c9","resolution":{"observed_at":"2026-08-01T09:46:28.858334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:28.938735Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:28.938735Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:1320605f4f5e9183815d566191d8c1087a4215c454b5657a4704af495c538ede","observation_id":"c60d009b-62d9-459d-81ad-09ed6cf20be3","resolution":{"observed_at":"2026-08-01T09:46:28.938735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:29.022796Z","title":"and Sutton, Richard S","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.022796Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:bee73651a60f2300472e1ada1c556eb19c73536f5e23779c2da841697fe56852","observation_id":"8dcc0069-7387-4d52-b8ac-641c722cc781","resolution":{"observed_at":"2026-08-01T09:46:29.022796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1507.01569","last_updated":"2015-07-06T19:28:36Z","snapshot_observed_at":"2026-07-06T04:23:00.037419Z","submitted_at":"2015-07-06T19:28:36Z","title":"Emphatic Temporal-Difference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.01569","snapshot_observed_at":"2026-08-01T09:46:29.108454Z","title":"Rupam and Yu, Huizhen and White, Martha and Sutton, Richard S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.108454Z"},"links":{"cited_paper":"/paper/1507.01569","citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:2ed2b68401c7f0cb7a85d9550a881c235b26414aea7095ee8289ff63fdf39142","observation_id":"d045ea08-1452-4842-b2e5-071285df8f3a","resolution":{"observed_at":"2026-08-01T09:46:29.108454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:29.170335Z","title":"Proceedings of the 36th International Conference on Machine Learning , editor =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.170335Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:3fb9709bafb441ab4c1d5f9e89e2fc7e709b2ed0a0ae509187f7667182abed36","observation_id":"f26be52c-0bff-4a54-9c4b-4f1a78ae801c","resolution":{"observed_at":"2026-08-01T09:46:29.170335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:29.234339Z","title":"and Barto, Andrew G","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.234339Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:6dc35a1bffadf03af1f59e42cb4896d4dd840a3785d5c294b287580f6ddce5a4","observation_id":"74685b5f-56a7-437c-8b90-2b48ab0da17c","resolution":{"observed_at":"2026-08-01T09:46:29.234339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:29.321734Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.321734Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:aeacb4750f8c9fadda6534ee9924c700bb1f51bd7488e7fb85ee51ace8a5d739","observation_id":"1c570934-fe12-4ded-bd34-9e11e6cf6a7d","resolution":{"observed_at":"2026-08-01T09:46:29.321734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:29.409296Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.409296Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:a517e5b1283758944c05637b53baf11821c2a26a117e32ae018ca308f3ad3906","observation_id":"7b87dec9-d3e2-4825-af9f-a6665c3fe3bd","resolution":{"observed_at":"2026-08-01T09:46:29.409296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T09:46:29.471827Z","title":"The Quarterly Journal of Economics , author =","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.471827Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:101f47b9d59cba1d79684d825d40958d50c5b57d1bacf55c2f8f42f0be3bfac8","observation_id":"cc83be04-d3b6-4174-bb82-402149819641","resolution":{"observed_at":"2026-08-01T09:46:29.471827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/xan0000097","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Journal of Experimental Psychology: Animal Learning and Cognition , author =","venue":"Journal of Experimental Psychology Animal Learning and Cognition","work_id":"ce949fc8-821d-487a-8e06-968c05c89743","year":2016},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.534738Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:cb726c70be3e18d872009ea40de7fd503fea71c5024cde0680ecd05d1243005c","observation_id":"97983768-4bb2-41ab-af8b-716bc2959b43","resolution":{"observed_at":"2026-08-01T09:49:09.912520Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1371/journal.pone.0007362","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PLoS ONE , author =","venue":"PLoS ONE","work_id":"3f0e30bc-1ac0-42d1-a9eb-312118c1381a","year":2009},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.603766Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:f491183be5e5624ab556cca8d0007fc8fc9f83ec0e800dd020a231ea615fb524","observation_id":"f190de95-9c10-4e11-a1d1-4fbe8ee3ef2d","resolution":{"observed_at":"2026-08-01T09:49:09.653416Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-01T12:19:50.454205+00:00","source":"paper_reference_links","state":"open"},"event_date":"2014-03-12","event_type":"correction","notice_doi":"10.1371/annotation/4a24a185-3eff-454f-9061-af0bf22c83eb","provenance":{"observed_at":"2026-07-11T02:58:53.321719+00:00","source":"crossref","source_record_id":"10.1371/annotation/4a24a185-3eff-454f-9061-af0bf22c83eb->10.1371/journal.pone.0007362:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.1102384","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Science , author =","venue":"Science","work_id":"3f4adfc8-31af-45d7-b79e-c6fa435070ff","year":2004},"citing_paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T09:46:29.680687Z"},"links":{"citing_paper":"/paper/2607.20656"},"observation_digest":"sha256:c23a37eb5c5e176bab553fbf392f9306c0588255ac5d53685a97cea43e6e8773","observation_id":"cb81715a-2a51-4587-b669-8eb875454bf0","resolution":{"observed_at":"2026-08-01T09:49:09.355067Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.20656","last_updated":"2026-07-28T22:49:40Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T09:46:45.751101Z","submitted_at":"2026-07-22T18:28:38Z","title":"Adaptive Multi-Horizon Reinforcement Learning"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2607.20656."}