{"as_of":"2026-08-07T09:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cb83286bbc027a7cfc8f1974199dac7847975988d3a6870998cc10d6df09454b","coverage":[{"denominator":105,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T07:32:30.418525Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02433/citation-record","integrity":"/paper/2608.02433/integrity","json":"/paper/2608.02433/citation-record.json","paper":"/paper/2608.02433"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:29.991221Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:29.991221Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:2118c36f4359c61dbf96db7db3e390f72c196c35e7f765bfa07480bf54b59056","observation_id":"4624a3d1-9050-4e37-9167-30066d66e14f","resolution":{"observed_at":"2026-08-04T07:32:29.991221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:29.997062Z","title":"Aminmansour, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:29.997062Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:05ef68adb13a245434ee036739288c9923538897de971f9303adb71abb626ff8","observation_id":"6ec2b844-f6d2-4f19-90fc-0838477d405e","resolution":{"observed_at":"2026-08-04T07:32:29.997062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.001153Z","title":null,"venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.001153Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:78219db661fcc85ff3acc0996a94c88ea44a74bad20bc79e478f30ab95e2dcdc","observation_id":"f9067b1e-f3d7-4b08-988d-720ea2dcac69","resolution":{"observed_at":"2026-08-04T07:32:30.001153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.006531Z","title":null,"venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.006531Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:eb721ae3f3f92f6405465e280dbe661c3ce2913a847c6ef08d1193193a0fe81a","observation_id":"c3a74243-70c9-4e68-b5de-c26485aa4247","resolution":{"observed_at":"2026-08-04T07:32:30.006531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.012431Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.012431Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:937eb7dd7f151a18451b2b14c812d9b456b7dfebb5b358e58522acad37477cc6","observation_id":"91df42c4-7802-4cc7-a0a5-c4fcae5b7b0b","resolution":{"observed_at":"2026-08-04T07:32:30.012431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.018241Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.018241Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:beaebf5a61bfc5187b2f278500fe2b96b933ac9789da2731f62ecd00ea533a72","observation_id":"3e82ff07-d6ea-49c7-82a7-cde0ae176541","resolution":{"observed_at":"2026-08-04T07:32:30.018241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.024221Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.024221Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:970844aea15dd0e3350d6290a6ebfce4308c5adddf5d7b11e881e7ac9052c986","observation_id":"c3166957-62ac-44ae-bb65-0294aea4497a","resolution":{"observed_at":"2026-08-04T07:32:30.024221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.029395Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.029395Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:32bbc2a6ba73b634965152c2fb7648ba4ffc422a805c1fb636a84598dcbf21c4","observation_id":"eef2615e-585f-4f4c-b5aa-546021b542f1","resolution":{"observed_at":"2026-08-04T07:32:30.029395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.033614Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.033614Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:7d6f09d31db27da4e241620b50981396a950ca6209d6166b616c6915d0aef44d","observation_id":"db9c35c0-318b-4b7f-b23c-2af54bf5c9df","resolution":{"observed_at":"2026-08-04T07:32:30.033614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.038776Z","title":"Bellemare, S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.038776Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:57db1f54db2ec845903b49c8b7fd3254cb3fbed160b71b4d5d41e517f703fa91","observation_id":"3e97f2f5-ea18-4eb8-ab4a-232bf2d65766","resolution":{"observed_at":"2026-08-04T07:32:30.038776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.043373Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.043373Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:4b517475fe331366a1b5706a40e7a8149a58bf97b8a106255f2422a29b0563e5","observation_id":"ada6518a-3ef9-4665-a877-553b2a100f65","resolution":{"observed_at":"2026-08-04T07:32:30.043373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.048462Z","title":"Bellman.Dynamic Programming","venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.048462Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:d806e3cca9aa03e9e07765f78b0e33fe7b1bd8771d0ac3044077f6b8eed80d0e","observation_id":"5154fa57-22af-46ad-80ef-0afdd155c752","resolution":{"observed_at":"2026-08-04T07:32:30.048462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.053812Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.053812Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:0d6c8db86e240a312004329ccaa2d9a2ab83b5b89844ff9dbbc6dc2d8cd0706e","observation_id":"07c14811-30c6-4958-816c-8682f8b503db","resolution":{"observed_at":"2026-08-04T07:32:30.053812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.059019Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.059019Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:59bf11abd4f7a2687bf9edc21ce049f3460ff183a2a6e9718dc3887b0611b818","observation_id":"58e2db0f-7939-44fa-821e-77cce5084ec5","resolution":{"observed_at":"2026-08-04T07:32:30.059019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.064376Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.064376Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:5621283c134d670bbeee53d2a4666149426a53490c11126f4d4a5e060532c13b","observation_id":"8ee67c47-3aa1-465d-80df-c0d7bd0801e5","resolution":{"observed_at":"2026-08-04T07:32:30.064376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.068750Z","title":null,"venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.068750Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:a1a09b5b1c5cb1febc18f1108b4083801c577e98472ce60fd73df08274df11a2","observation_id":"77cc4fae-0d0f-450f-a162-b4fecefe798b","resolution":{"observed_at":"2026-08-04T07:32:30.068750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.072426Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.072426Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:4b22cc591d19b347002592f30921df76fda15fa660d683b18438b0179a250a4f","observation_id":"b7191b5b-6db6-43b5-bef4-2a6941277555","resolution":{"observed_at":"2026-08-04T07:32:30.072426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.076441Z","title":"Chen and L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.076441Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:20866af784067ef702bbfd0b47ff858d8f293cb3ebd6b8d1b58d914c24dd1afb","observation_id":"4555af97-cc72-4b9e-95bb-b7fd58b889a7","resolution":{"observed_at":"2026-08-04T07:32:30.076441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13187","last_updated":"2025-03-08T06:36:16Z","snapshot_observed_at":"2026-08-05T18:44:27.455258Z","submitted_at":"2025-02-18T12:57:29Z","title":"A Survey of Sim-to-Real Methods in RL: Progress, Prospects and Challenges with Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13187","snapshot_observed_at":"2026-08-04T07:32:30.080353Z","title":"Asurveyofsim-to-realmethods in RL: Progress, prospects and challenges with foundation models.arXiv preprint arXiv:2502.13187, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.080353Z"},"links":{"cited_paper":"/paper/2502.13187","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:30f578edb2f679751a184ad2e14b9e41161e183f2c39d6537db14998a34ace21","observation_id":"47a5397d-5e5c-48ed-8c46-03a9920a867a","resolution":{"observed_at":"2026-08-04T07:32:30.080353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.084323Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.084323Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:e224b6a32ce5c92907b7b65dff795afe3a4622cfe898049be640166961ce7862","observation_id":"86f71ae6-9b94-4b3a-96a1-52eff82f5549","resolution":{"observed_at":"2026-08-04T07:32:30.084323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.088317Z","title":"Degrave, F","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.088317Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:fb7ccf643096765f1fd96ba253a58253398f1d1cf8ad07526c0e244478ce655e","observation_id":"8d43ea43-fe03-4970-8f57-068d7e7abc1e","resolution":{"observed_at":"2026-08-04T07:32:30.088317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.092574Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.092574Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:9ed559ae31419182542a9efee291790de7807ddb3150410dc6832f6e03e541e7","observation_id":"168012ea-afc1-4688-a771-7fc737f46089","resolution":{"observed_at":"2026-08-04T07:32:30.092574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.097892Z","title":null,"venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.097892Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:e26911ffd4fe3de0d9cdec3d4e251fb4114311d8b4f6a3f55d542e6cb3cc964e","observation_id":"daee70df-c957-43f7-a7c2-aa44af90e63c","resolution":{"observed_at":"2026-08-04T07:32:30.097892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.102396Z","title":"Challengesofreal-worldreinforcement learning: Definitions, benchmarks and analysis.Machine Learning, 110(9):2419–2468, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.102396Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:8d12cf2f4ce47445b919fa04634972e55427ca64147270e83217354d720a62cf","observation_id":"db268447-3e15-4674-97aa-8a8bf48c4cb4","resolution":{"observed_at":"2026-08-04T07:32:30.102396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.106867Z","title":"Pinknoiseisallyouneed: Colorednoiseexploration in deep reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.106867Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:9d6a0f5b2ffe92cfe57e4eae79aef6e9c752073ee2c50def7b231afb1069e8bb","observation_id":"45f80fa8-f7fe-41dd-b6f3-219170f20197","resolution":{"observed_at":"2026-08-04T07:32:30.106867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.111219Z","title":"Eberhard, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.111219Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:cc5a1485c751399fa9f4901d9e164b2a8fd94b104b299c22d8c61cfb170f4d59","observation_id":"c5ac35c4-7b04-4a12-8aed-c275123bda63","resolution":{"observed_at":"2026-08-04T07:32:30.111219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.115215Z","title":"Eberhard, C","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.115215Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:20e83de5548da36c4a676394569afadb29d29f88b5450ac3ac62f180bb5985ec","observation_id":"b0c665a5-e08e-4fb1-93e9-270aecfe15f6","resolution":{"observed_at":"2026-08-04T07:32:30.115215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.119443Z","title":"Elelimy, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.119443Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:d03ac4df76fdb402d40d6d84d492ae235602ebca80ea4ca4a67a2d1ba308ce88","observation_id":"00f476f7-314c-49a3-9e3b-82f04b074e99","resolution":{"observed_at":"2026-08-04T07:32:30.119443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.123249Z","title":"Elmkaiel, S","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.123249Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:9cc7b3bbc1088091500ec7ea8af673ced1c8b78f299d4881abf1d70f7adc762c","observation_id":"a1dfb60b-fc65-4ac7-a3f9-267842eb3557","resolution":{"observed_at":"2026-08-04T07:32:30.123249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.127114Z","title":"Fujimoto, H","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.127114Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:de8f7d8ffaf540158a03bd2b4248e1ccc8585e9129485ebcfb73b1ab091f5bdc","observation_id":"433bc4dc-b2c3-4ac0-a189-6204a5211423","resolution":{"observed_at":"2026-08-04T07:32:30.127114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.130790Z","title":null,"venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.130790Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:5e1e3e0fcf31e3afb8a93b36f38f956260f53eeb7db16a2b47224a913643e1ef","observation_id":"e4944d07-6b05-422d-9fa5-acf927defb59","resolution":{"observed_at":"2026-08-04T07:32:30.130790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01843","last_updated":"2024-12-09T06:38:53Z","snapshot_observed_at":"2026-07-06T18:09:12.980337Z","submitted_at":"2024-05-03T04:26:03Z","title":"Closing the Gap: Achieving Global Convergence (Last Iterate) of Actor-Critic under Markovian Sampling with Neural Network Parametrization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01843","snapshot_observed_at":"2026-08-04T07:32:30.134695Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.134695Z"},"links":{"cited_paper":"/paper/2405.01843","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:def814716183258b5a03adaeec1a02cb24575da18cab5828547a2ba803a784d1","observation_id":"84c11b3d-0c87-4386-92af-c82dfaa666dd","resolution":{"observed_at":"2026-08-04T07:32:30.134695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.139263Z","title":"Golowich, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.139263Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:1c8aef2837055a5483d75068d17d82c51a56727884dfd26601c0b220e6eaae34","observation_id":"3c40776f-ccaa-445e-9479-b64ffe6c80b6","resolution":{"observed_at":"2026-08-04T07:32:30.139263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.143016Z","title":"Goodwin and K","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.143016Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:c8e59a830c9d34a93236a959b4fee146bc06ef328d63a926e1a5cd3ebf0c9177","observation_id":"d2c7fbb4-aa9e-419f-9497-1a89ef8ec991","resolution":{"observed_at":"2026-08-04T07:32:30.143016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.146989Z","title":"Graves, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.146989Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:680daef4f39dd8e3161077bdba289980a05e69ba84133083f96695a86e3dbb1b","observation_id":"395c0b7f-eee6-4bad-8ffc-02106f464a6d","resolution":{"observed_at":"2026-08-04T07:32:30.146989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.151607Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.151607Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:842c63c3f1aa1c54d4f22d0e6e56dde0330444cbf7b3dcfb980c97ee2c02770c","observation_id":"41cc08b5-2629-4703-a897-ed3fd013c7f9","resolution":{"observed_at":"2026-08-04T07:32:30.151607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24527","last_updated":"2025-09-29T09:42:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T09:42:27Z","title":"Training Agents Inside of Scalable World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24527","snapshot_observed_at":"2026-08-04T07:32:30.155141Z","title":"Hafner, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.155141Z"},"links":{"cited_paper":"/paper/2509.24527","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:e62645125352fd53ff626ddd38aca78fe810702e8ad74ac893df520e213fe4d6","observation_id":"c4de9c23-5aef-49f3-9ffa-9c21341757a7","resolution":{"observed_at":"2026-08-04T07:32:30.155141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16828","snapshot_observed_at":"2026-08-04T07:32:30.159389Z","title":"Hansen, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.159389Z"},"links":{"cited_paper":"/paper/2310.16828","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:a6f59e32f9e4ace1e700af0193b15c7b8ab6bbff46758d8d1d7e4d393d460e83","observation_id":"774caefe-2b92-48c0-b5d0-5321a6fcd222","resolution":{"observed_at":"2026-08-04T07:32:30.159389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07324","last_updated":"2025-03-10T13:39:57Z","snapshot_observed_at":"2026-08-05T13:07:09.714055Z","submitted_at":"2025-03-10T13:39:57Z","title":"Decision-Dependent Stochastic Optimization: The Role of Distribution Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07324","snapshot_observed_at":"2026-08-04T07:32:30.164939Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.164939Z"},"links":{"cited_paper":"/paper/2503.07324","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:77c41d479cda5cceff00c5833d6f23b8d01508f8a64c91307116a0363648380e","observation_id":"abb74544-5875-4b73-8323-1c66c27d23bf","resolution":{"observed_at":"2026-08-04T07:32:30.164939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.169441Z","title":"Hewing, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.169441Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:56d9ef0b0c881fed9870b4aefdc89d476b5a6d6dea5c064658894f8ce2118759","observation_id":"066f8d2d-fd16-4e72-8ff4-2b30efd6e6a1","resolution":{"observed_at":"2026-08-04T07:32:30.169441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.174195Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.174195Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:c9df252d4d57fa4dfe70324eb4ed1b9d7cd028e50f62079c492087f7fb9bf8ba","observation_id":"727b2b63-d9b7-4e27-b575-600b552389da","resolution":{"observed_at":"2026-08-04T07:32:30.174195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.178758Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.178758Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:4356501436ef7a69177a938e208f56c902f5ecbd2c23c1c6c50892e95e9b268f","observation_id":"1c86423a-16f1-4283-8008-0be6075f4fd0","resolution":{"observed_at":"2026-08-04T07:32:30.178758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.183511Z","title":"Near-optimalregretboundsforreinforcementlearning.JournalofMachine Learning Research, 11(51):1563–1600, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.183511Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:f9f229df1ee5de561d8d0cdfc81b0a30770e90cc55ba2f93d2f6467962cd400d","observation_id":"da184efc-be07-4dcf-bb2a-4dace0ba7342","resolution":{"observed_at":"2026-08-04T07:32:30.183511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.188072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.188072Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:e8dfa3648d63b541bdb59e70052666cd9c5f099c6bd7a1401c2a91ea2d3f5c6c","observation_id":"0d450e42-e675-46ce-ae34-ac605312974c","resolution":{"observed_at":"2026-08-04T07:32:30.188072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.191668Z","title":"Ostrovski, J.Quan, R.Munos, andW.Dabney","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.191668Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:b9c4307cf7ebf3f50fa0ddc9bb9f23417b1694116e7ec9f9d3f851af1234131b","observation_id":"85c09e89-4bd8-43bd-957f-976bdc3420dd","resolution":{"observed_at":"2026-08-04T07:32:30.191668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.196119Z","title":"Karafyllis and M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.196119Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:b2b3e61afe299aa060cbbc3656b988b0628268d59e55985de927218174722d0c","observation_id":"0ba949b9-a218-4ae6-a323-78e44ae891fc","resolution":{"observed_at":"2026-08-04T07:32:30.196119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.200360Z","title":"Karmakar and S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.200360Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:7db411947a4bef050023969143773c3f6d36e37f77c5ac6e5d4a2e861f6489a3","observation_id":"fee1702b-ab0c-49e0-9a42-66ceac451e00","resolution":{"observed_at":"2026-08-04T07:32:30.200360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.204202Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.204202Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:cdd4db28dc4dcb85fc394b70d3bef9120adf5cb207160e0f26cf3beede7b2929","observation_id":"585da1d6-b8c6-4466-9316-56277713d264","resolution":{"observed_at":"2026-08-04T07:32:30.204202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-04T07:32:30.208468Z","title":"Adam: Amethodforstochasticoptimization.arXivpreprintarXiv:1412.6980, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.208468Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:38ceb84ebfef0656099e40c13e034b45151b22ea6755a6b728cf8ff3f180857b","observation_id":"adb3eb24-1ef7-4f39-9d08-19e05dac891f","resolution":{"observed_at":"2026-08-04T07:32:30.208468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.213460Z","title":"Kocsis and C","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.213460Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:0126839e791c8f16efb43eb90f97eb593a4a4ba67451c8ffe39ea30656581773","observation_id":"ee4b53a4-ce63-4376-909d-869ddcdc631e","resolution":{"observed_at":"2026-08-04T07:32:30.213460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.217223Z","title":"Krishnamurthy, A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.217223Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:c0d899e1a235be81f9e52c33356a7771905ed792c6492ce3c86254390ed45f04","observation_id":"d261f1ae-aac1-4727-ab62-960e28d003a0","resolution":{"observed_at":"2026-08-04T07:32:30.217223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.221536Z","title":"Krstić, I","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.221536Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:f53ca9bb0c521d2b61a18d97f338901a84313d2c40772f0d4febd28a68e34130","observation_id":"9cea11ab-88cd-4cc4-93aa-6bd3a434e6ce","resolution":{"observed_at":"2026-08-04T07:32:30.221536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.226308Z","title":null,"venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.226308Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:f27f5eebb6769f8761632549ce42f2fffe63fca5504c481b6d42a8e477c5a9cf","observation_id":"4c538afa-e2bf-4ec7-91d9-ae6361aab198","resolution":{"observed_at":"2026-08-04T07:32:30.226308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.230023Z","title":"Lai and H","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.230023Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:1e51fb57c3ad09d8a071caa885bd56f7bb455ea2f5899f1f75868c4f41d8da33","observation_id":"a108fd6f-0153-47f1-ae4d-5cb32425d49f","resolution":{"observed_at":"2026-08-04T07:32:30.230023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.233537Z","title":"Sample-basedplanningandlearningwithfunctionapproximation.Statistical Sciences, 40(4):517–545, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.233537Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:f83fae12a18814451155bf49b9ba36117651c8aec7ad3088965e2d24e352d9c3","observation_id":"0a7d94e7-9afa-42e3-9007-ee783159965f","resolution":{"observed_at":"2026-08-04T07:32:30.233537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.238072Z","title":"Lauri, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.238072Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:ff3b52b7936554a75735daa2c8f545821959e97c0faff0506b32a674a8aa272b","observation_id":"9ae738fc-d42f-4693-bc0e-1603ce213fef","resolution":{"observed_at":"2026-08-04T07:32:30.238072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.242042Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.242042Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:e789751c839e6ccef9fec613a7ada6c8c8e03159a44d674e3a5e1df7f60cfd9d","observation_id":"30be9447-6b5d-4787-9e56-62c9e0519691","resolution":{"observed_at":"2026-08-04T07:32:30.242042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.246400Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.246400Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:573e674acad0cf3cb7fc476d9d7ba22b9a6ec417304d1643059e3f00b7209f9d","observation_id":"501ba220-aac0-4efd-802c-c8bc351b5a9a","resolution":{"observed_at":"2026-08-04T07:32:30.246400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.250679Z","title":"Memorylesspolicies: Theoreticallimitationsandpracticalresults","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.250679Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:ddbc0e3aa5596484ae5badbf539d1e84c1ac358461c96d79242674a841c08caf","observation_id":"7207e1f9-16e8-4502-932c-6d0c423ae2a8","resolution":{"observed_at":"2026-08-04T07:32:30.250679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.254891Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.254891Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:b90825ef2cf87cb497d4140c6dee75570c906558cbd5058d029bc2cb5a8cfc54","observation_id":"58f74e4e-6570-4ec8-96c0-46b15f42e313","resolution":{"observed_at":"2026-08-04T07:32:30.254891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.258776Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.258776Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:cff34c4c75e7d245cb7a56127017b518bfe078e4559185639b240d51387b1444","observation_id":"f20eb4f8-b8f5-43ff-b845-1805938ee06c","resolution":{"observed_at":"2026-08-04T07:32:30.258776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.262613Z","title":"Reinforcementlearningwithmodel-basedfeedforward inputs for robotic table tennis.Autonomous Robots, 47(8):1387–1403, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.262613Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:8d568966d91a59d69d30d4e777d985c25eee8419318af4090c73569336d3a979","observation_id":"afb474a3-56ac-4bad-8674-1bc9e4531ada","resolution":{"observed_at":"2026-08-04T07:32:30.262613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.266325Z","title":"Martius, R","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.266325Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:5c592f450a4c3d6bdf555ab09eefb064c4a79ce2446b349c005e273cc4b72095","observation_id":"7e57d8c4-317b-493b-9eaa-14989ba602e6","resolution":{"observed_at":"2026-08-04T07:32:30.266325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.269668Z","title":"Mishkin and L","venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.269668Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:a31ce01e9a7175c0b9ce277576aa13b29bc8ae3f594ef30f8418ed1b3dfdbee6","observation_id":"6e9505ed-9add-4b94-b63a-50a3cc23aac0","resolution":{"observed_at":"2026-08-04T07:32:30.269668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.273793Z","title":"Fidjeland, G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.273793Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:ac00964e86c3b69d4c8a69e61c60f09275018a7e6507ea3784ed9ebb38772774","observation_id":"00cdc8b8-a704-452d-a981-96aae7f4051d","resolution":{"observed_at":"2026-08-04T07:32:30.273793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.278109Z","title":"Mohri, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.278109Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:0f194ae4a3c9ce1de700bfc6cc3bad40ac01adbca957e0faf29bcd512344b1e1","observation_id":"46c102d7-7309-4ad5-b2dc-9ba102c9cfe2","resolution":{"observed_at":"2026-08-04T07:32:30.278109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.281749Z","title":"Muehlebach, Z","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.281749Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:b9233684ef75f2ddba35184841364b9ca42655ed1aaff11d7c6fa99f90b3f24f","observation_id":"17e4a84b-870a-47eb-9ee3-e729fcff770e","resolution":{"observed_at":"2026-08-04T07:32:30.281749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.286599Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.286599Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:deed0ad24c0d570a7ea046658b8f63c89935bcba711ebdef897ef59e25723480","observation_id":"74ed9770-04be-4050-9a1b-e93fcd5b4131","resolution":{"observed_at":"2026-08-04T07:32:30.286599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.290812Z","title":"Osband and B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.290812Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:6dbac9065cd8a189c9880775dc192415daca0a4666fefa854cfa8bcc2001f1a3","observation_id":"ec1feacd-58a4-48a5-a866-a404ed98fbb9","resolution":{"observed_at":"2026-08-04T07:32:30.290812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.294697Z","title":"Osband, C","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.294697Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:d83905580a425cc598c3159d590b3124ee23fe645d93e523a9a6b5b9c35f0795","observation_id":"c3aee3b7-2e0a-480e-b515-73e28235a192","resolution":{"observed_at":"2026-08-04T07:32:30.294697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.298233Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.298233Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:82dded0e51c1321eb630f4f8913f2a4275b4dc9f03dbcb364ee8a734e7e63fa9","observation_id":"e3fd2a37-2872-43fa-a1f4-303c36dc77ef","resolution":{"observed_at":"2026-08-04T07:32:30.298233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.301822Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.301822Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:de5aed52c3fb45451147972898652d4c592d5fab730cea9fcb39a2a6e123b24f","observation_id":"51d89761-e8dd-44a4-a6aa-27ac2eb746e8","resolution":{"observed_at":"2026-08-04T07:32:30.301822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.305273Z","title":"Patterson, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.305273Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:8e1491e206a724749c69da705c0e775663f1ae6ef5f218773621b2a1d8b93149","observation_id":"1e0588c1-ebd7-4bf1-8e70-ac5db3e1a313","resolution":{"observed_at":"2026-08-04T07:32:30.305273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.309552Z","title":"Patterson, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.309552Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:892d29f173b014ce3178bdc14286ec01bc856b3451125f76d053dc554d11d0b2","observation_id":"7ceffb89-d8c8-4cef-897c-77bc93ec26d2","resolution":{"observed_at":"2026-08-04T07:32:30.309552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.313275Z","title":"Piazza, G","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.313275Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:eea075e920c367731bc1ded6ff8989c41859257c8ba34bf4cb069cd36f43a942","observation_id":"6c3a0a2c-eb9d-418d-80f8-ffa44bff8f0e","resolution":{"observed_at":"2026-08-04T07:32:30.313275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.318721Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.318721Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:276786ed23717b7350edacc21f89c41ea723530e59eb18cda562203c589157d5","observation_id":"7371d436-a961-47be-940d-a9d892698ca7","resolution":{"observed_at":"2026-08-04T07:32:30.318721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.323534Z","title":"Rosenblatt","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.323534Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:0f5b30d460167916f976cee0b057a3320a756e6deaa6c10db46b3e938b6fef6c","observation_id":"b0ccdaec-01b0-46a2-86a6-1a519fccb6e0","resolution":{"observed_at":"2026-08-04T07:32:30.323534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.327495Z","title":"Sastry and M","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.327495Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:0aad221151eae4dd534973ed66a902845bec7990f8c1d42736616598a47a6a13","observation_id":"b0989654-ed12-4332-98fb-6b6feb9e5339","resolution":{"observed_at":"2026-08-04T07:32:30.327495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-04T07:32:30.331417Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.331417Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:d10e32da4863126ebf5fc64196b13a857ed037ef6161d2d7e61db67bda858524","observation_id":"98c719ed-fb64-4d78-9597-6aa9d73dff75","resolution":{"observed_at":"2026-08-04T07:32:30.331417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.336827Z","title":"Silver, G","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.336827Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:eef36928f6bbfdd9e216e90459848cb8d481d2cd61ff2ed6eb69f933a3ac0499","observation_id":"1e37b9ee-508e-4acc-b9ae-871999074979","resolution":{"observed_at":"2026-08-04T07:32:30.336827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.341889Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.341889Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:41b3043cf981f8d4d7f289ee0a7e6efb00255c3025d774752de722a213e33051","observation_id":"d4353d7b-0ae5-4c86-a764-00d6652a7c72","resolution":{"observed_at":"2026-08-04T07:32:30.341889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.01815","last_updated":"2017-12-05T18:45:38Z","snapshot_observed_at":"2026-08-02T00:39:04.960144Z","submitted_at":"2017-12-05T18:45:38Z","title":"Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.01815","snapshot_observed_at":"2026-08-04T07:32:30.346555Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.346555Z"},"links":{"cited_paper":"/paper/1712.01815","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:0f278d33c317b0e27cf67135d4bd63212cddcebd7ed28cd053636af55a4dcfd9","observation_id":"edc4bf42-44e2-447e-a659-8ae9579e2675","resolution":{"observed_at":"2026-08-04T07:32:30.346555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.351373Z","title":"Smyshlyaev and M","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.351373Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:5520c65eba05bff018b2463efa74657cd698d28e575307c2d0ce2ca8f1d96906","observation_id":"67705e7a-4d3a-413e-a092-0b922718efa6","resolution":{"observed_at":"2026-08-04T07:32:30.351373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.355510Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.355510Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:ab72fa2435e1c461d6f120bf13adf36dbba40a4eda6c323e54bdfaad0b79dccf","observation_id":"e009efb4-4f59-46b6-a99b-bdf5e83d9b64","resolution":{"observed_at":"2026-08-04T07:32:30.355510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.359915Z","title":"Sukhija, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.359915Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:cec91022f1b05e30a08374d7e639c50f54552ebe87071c0c1fecb505a89276fb","observation_id":"c2cb7d4d-fa26-4956-a950-f12622f1fef4","resolution":{"observed_at":"2026-08-04T07:32:30.359915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.363264Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.363264Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:48ff773b029b1bc262f16e961af546a820139c29f9a6884cdf3766c1d022f9c2","observation_id":"32d54f85-f7f2-4f70-af47-76f6b792d261","resolution":{"observed_at":"2026-08-04T07:32:30.363264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.368050Z","title":null,"venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.368050Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:42487edd104a82049a089a8d7002219c3b38be38b27a94168943b78792a1ebf4","observation_id":"02a862b2-e9dc-412f-a19f-782ed664152d","resolution":{"observed_at":"2026-08-04T07:32:30.368050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.372459Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.372459Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:c8c2040f2b411bac25099088db6e2b4db140b1b292f2f86c68fee3d78fa3445d","observation_id":"82a66b31-05d4-461d-8340-67f173a7914a","resolution":{"observed_at":"2026-08-04T07:32:30.372459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.375946Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.375946Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:b16b8ee2ea5c9315d1521f6083a4eb4c0967622e6bc1d7b712da67d18f75e04e","observation_id":"973cef41-fecf-4e6e-9616-30ebb6675a53","resolution":{"observed_at":"2026-08-04T07:32:30.375946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.379617Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.379617Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:61bf58cbaa353c7356192845d4234f4fcc04448191072ace5892390a0f420afc","observation_id":"b95286e3-fb15-4aa9-8f9e-7a1a4f58650e","resolution":{"observed_at":"2026-08-04T07:32:30.379617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.383741Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.383741Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:e8103484c2f71642871e96eaa1d3a8c467ec066dabe77083d8bf6e89c5779b76","observation_id":"5fac5015-b843-467d-b903-03b228ad71a8","resolution":{"observed_at":"2026-08-04T07:32:30.383741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-04T07:32:30.387942Z","title":"Tassa, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.387942Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:5b3acedb5f0e89cebacb2192b982cb11520e13af744abb64c07203d9b5003038","observation_id":"0ec7be16-0215-43c3-aad1-4acc6a7d934a","resolution":{"observed_at":"2026-08-04T07:32:30.387942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.391523Z","title":"Tayal, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.391523Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:16906fd11dd6a9f927cf6ba12e6d20693361c4ae55da5a858cf6d44bd2b7ce20","observation_id":"8338c15d-d754-403e-a98f-9268b98d11c7","resolution":{"observed_at":"2026-08-04T07:32:30.391523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.395000Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.395000Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:522d511b3b2053a1e236bdacc2bbaba5a925906102aab4ed677d20b6c6c3798a","observation_id":"6c187f98-0e30-4421-a1da-0bf4b26044a6","resolution":{"observed_at":"2026-08-04T07:32:30.395000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.398575Z","title":"Todorov, T","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.398575Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:7f45d336ecb10d6e2ab364eccd59d720caeefe5b9980f11739440c6b9be26b41","observation_id":"ae20b7c9-f9b8-485b-ac80-128e6e568d05","resolution":{"observed_at":"2026-08-04T07:32:30.398575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.401995Z","title":"Analysisoftemporal-diffferencelearningwithfunctionapproximation.Advances in Neural Information Processing Systems, 9, 1996","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.401995Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:6019abe0e36a4da78af674c7fc519fd5b73abcdb55980fc85cb7fc811fc42a3d","observation_id":"1dbedad2-57de-4922-8dbd-3cda4367ef81","resolution":{"observed_at":"2026-08-04T07:32:30.401995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.406158Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.406158Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:0edbcc718fb08fc7292ce01855c0a2fe370c34f62048fe254f464cc6f5eb003f","observation_id":"76765e40-38e2-4b38-964c-c5eeb18502f2","resolution":{"observed_at":"2026-08-04T07:32:30.406158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.409812Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.409812Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:b9c4601924e551279bee4486f36ad0545690169433e5606e758cd1774fbb8dd2","observation_id":"13c2d2f2-4d77-4c65-a022-c5ad7665bcb9","resolution":{"observed_at":"2026-08-04T07:32:30.409812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.414332Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.414332Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:2122add1b973e3825e7ea99fa4c478f7a34fe41ad4e4ca7142c27e06b86727f5","observation_id":"e844c06a-1044-4ce7-91cd-196cb66a7493","resolution":{"observed_at":"2026-08-04T07:32:30.414332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:32:30.418525Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-04T07:32:30.418525Z"},"links":{"citing_paper":"/paper/2608.02433"},"observation_digest":"sha256:973172d9b17c19c17eaf19718d605379c827fedbda3ce90c3247cb40deb8e94c","observation_id":"a9aecf77-2545-4b41-99e4-5d8ccf1affb6","resolution":{"observed_at":"2026-08-04T07:32:30.418525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02433","last_updated":"2026-08-03T16:12:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T06:21:17.583959Z","submitted_at":"2026-08-03T16:12:29Z","title":"Foundations of Reinforcement Learning and Control:Connections and New Perspectives"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":105},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 105 outbound references and 0 inbound Pith citation observations for arXiv:2608.02433."}