{"as_of":"2026-08-16T16:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f39a9469bcb2ab7d2af6c50b8144357c8818ecf32f86e89773c1447920473b38","coverage":[{"denominator":96,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":96,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:55:08.514467Z","state":"measured"},{"denominator":96,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":96,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03562/citation-record","integrity":"/paper/2608.03562/integrity","json":"/paper/2608.03562/citation-record.json","paper":"/paper/2608.03562"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.107121Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.107121Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:2ff25b00739d812985861b4c6be95accd7afda55587d6ac5b24476579ea4d094","observation_id":"3ffec192-ae38-4486-b636-786ddc94a623","resolution":{"observed_at":"2026-08-15T14:55:08.107121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.111366Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.111366Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:109b801489c831ec34bcc36bcb929dc7f283cef6129d20367c1cc3ba4c565485","observation_id":"fd29e291-4479-49d6-8c4b-c0afb1e04f22","resolution":{"observed_at":"2026-08-15T14:55:08.111366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.115617Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.115617Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:685d0da92a72058c17cd55e3625ab55e20e63077e005186c1f1f2dbdfba054d6","observation_id":"138dc422-dad7-4df0-b203-d6e668f64379","resolution":{"observed_at":"2026-08-15T14:55:08.115617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.120369Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.120369Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:39bb0ed6d33f549b219bdd492e59b8c9113e4d2435a2a2d5dde980c1e7aa47b8","observation_id":"5450d6d9-95e5-4a8a-8228-19b2c6356c24","resolution":{"observed_at":"2026-08-15T14:55:08.120369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00991","last_updated":"2023-08-29T09:23:24Z","snapshot_observed_at":"2026-08-16T16:27:18.557869Z","submitted_at":"2022-10-03T14:57:46Z","title":"Policy Gradient for Reinforcement Learning with General Utilities","version":2},"cited_work":{"arxiv_id":"2210.00991","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.00991","snapshot_observed_at":"2026-08-15T14:55:08.844282Z","title":"Policy Gradient for Reinforcement Learning with General Utilities","venue":"cs.LG","work_id":"560a74e9-fb9a-42df-9630-7ec6fd4ebd19","year":2022},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.124826Z"},"links":{"cited_paper":"/paper/2210.00991","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:5af65f3d4bf1f5bcd53f2c4f0f4beb7afa75f9800b3b50002b43245f9a1a4d64","observation_id":"60ff3331-aebe-468e-9113-7fd653844445","resolution":{"observed_at":"2026-08-15T14:55:08.848775Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.130299Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.130299Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:d1d85653405d3744af891ca6ae547fd5fae5d8c4edb81e093cb1680cde498bba","observation_id":"cd00eb0e-a7f1-46e2-8a14-cb2e1385565c","resolution":{"observed_at":"2026-08-15T14:55:08.130299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.134774Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.134774Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:50ee0c76cee9628dd6f758db895c9883d9fb19f1338e3e53ce3a884c54bceeb8","observation_id":"16b6b10c-9cf6-43e0-9cf2-b511a48049c6","resolution":{"observed_at":"2026-08-15T14:55:08.134774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.139091Z","title":"2021 , publisher=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.139091Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:adfdff292fb3133344ba0cec23d2912eb2693d8faa0652e65c2cd8ba0377bffa","observation_id":"21dbc922-60c7-4e78-ad3e-3ed6395235d5","resolution":{"observed_at":"2026-08-15T14:55:08.139091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.143656Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.143656Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:b092dfbb8c1815d63cae90048d77ecb7ca7887ad97dd350595ef4a5f3939357c","observation_id":"e7c5028b-8c92-48b0-a76f-3f3d2bfc2351","resolution":{"observed_at":"2026-08-15T14:55:08.143656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.148426Z","title":"2008 , publisher=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.148426Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:f087c527b9bacaaabf33491619b1bea2b0585bb9909c08a2acfbb90379adec5a","observation_id":"0f209b2b-177d-4692-8c69-280c87f9bf71","resolution":{"observed_at":"2026-08-15T14:55:08.148426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.153124Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.153124Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:192f1ab6a3652e7635f4068a175b4734196b52701a0f9697449ec9aa8d6b082a","observation_id":"3d046025-3d16-46a9-a417-cccf812cfa91","resolution":{"observed_at":"2026-08-15T14:55:08.153124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.157667Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.157667Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:25ba5b33d7e7400ea97a8555b148ea0b8835a78618391e5c6c62c6ba24a160ab","observation_id":"29ab154d-4e1b-41d3-81b5-e95de562518f","resolution":{"observed_at":"2026-08-15T14:55:08.157667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.162420Z","title":"2021 , publisher=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.162420Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:8384d2adeb274bc18d48d54c9fa618594678136d8970bd56d8a603c5666ad3a9","observation_id":"ef62a4fa-66c0-4194-ae6f-3ae3e4b6f500","resolution":{"observed_at":"2026-08-15T14:55:08.162420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.167013Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.167013Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:f64c7a6be945fd0bb145bcaaf360f059759a240f7faf7546aaf49f6f1a72ed8f","observation_id":"11df5ba3-ead7-4f9f-8e4b-cdf85efd5a30","resolution":{"observed_at":"2026-08-15T14:55:08.167013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.173015Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.173015Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:cc8e75d3286c6194452bfbabe10336c044ad5d113760421daa79febb8885a545","observation_id":"31aa4cfa-a88d-407c-b285-d316377119ae","resolution":{"observed_at":"2026-08-15T14:55:08.173015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.179216Z","title":"SIAM Journal on Applied Mathematics , volume=","venue":null,"work_id":null,"year":1966},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.179216Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:182696afd3ed4b9d5521895aab9c67f20dcd3439fb0cd03ccbb74265a7473cdd","observation_id":"791ae31b-98ba-4886-944f-67be46dd833a","resolution":{"observed_at":"2026-08-15T14:55:08.179216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.184087Z","title":"Operations Research Letters , volume=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.184087Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:5bc12013719cb9229b920a163eca422d01d9f1d329355ab5d2c4d43dcc490b1b","observation_id":"51d1b936-5783-4e16-b584-941b1ab1f3f0","resolution":{"observed_at":"2026-08-15T14:55:08.184087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.666700Z","title":"Lecture notes","venue":null,"work_id":"755286b1-2539-4045-abb2-2223f37c3cbf","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.187931Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:a002abd0db941e1f2d7d1a4f46e3cbf2fd22785e0fd06eaba1b97260602e6e8a","observation_id":"f5904724-6ccc-4756-8070-a1a29e8c936b","resolution":{"observed_at":"2026-08-15T14:55:09.670768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.649498Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"5225618f-6c6e-46eb-b384-eb62c2d4a040","year":2023},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.192886Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:259529cb2b8a0fa7dde836c68a06eca3a538704c0072a3758a32cea937aa6097","observation_id":"ccd4b6fb-9672-4dee-9ff1-9fc72da93d31","resolution":{"observed_at":"2026-08-15T14:55:09.653993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01992","last_updated":"2019-01-06T22:00:10Z","snapshot_observed_at":"2026-08-14T17:34:33.220218Z","submitted_at":"2019-01-06T22:00:10Z","title":"Large-Scale Markov Decision Problems via the Linear Programming Dual","version":1},"cited_work":{"arxiv_id":"1901.01992","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.01992","snapshot_observed_at":"2026-08-15T14:55:08.826845Z","title":"Large-Scale Markov Decision Problems via the Linear Programming Dual","venue":"math.OC","work_id":"a60a8224-3b12-4567-84e4-779045b820e6","year":2019},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.196587Z"},"links":{"cited_paper":"/paper/1901.01992","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:1c75b6c8f70f1976467ad219b9829e728e66a97f04543a41cb520269d277222d","observation_id":"dbf95b70-b330-42da-a1eb-653c82dc923f","resolution":{"observed_at":"2026-08-15T14:55:08.831865Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.200832Z","title":"2004 , publisher=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.200832Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:c0ac0a672c0fb01c15452da9b90c103b90b9393394fc3a1726c831185a577c26","observation_id":"3f4c010d-e6d1-4a85-acf5-1b5b75fcfc47","resolution":{"observed_at":"2026-08-15T14:55:08.200832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.204652Z","title":"SIAM Journal on Optimization , volume=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.204652Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:cdbf494643ac8ceefb2b72fd4b02cf069dfe0a89fa727a857ac7b9e7e8f20c4d","observation_id":"d5bedb12-042c-4c09-8edd-014eec4bad44","resolution":{"observed_at":"2026-08-15T14:55:08.204652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.208316Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.208316Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:b929c6ccd6d5a923bbe83a0a69bf0b725a652bb17baeaf938e1bdb2d92c65ad5","observation_id":"8f1a0ac2-2989-4b5c-a9df-9a0990150a36","resolution":{"observed_at":"2026-08-15T14:55:08.208316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.212027Z","title":"Proceedings of Thirty Third Conference on Learning Theory , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.212027Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:2aeb4fee294388018e791180357ed4aa398cf6b35d47b9b834fbb7eda15fcf78","observation_id":"081c5657-3391-4eb8-9908-d98103b9b0f3","resolution":{"observed_at":"2026-08-15T14:55:08.212027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.595382Z","title":"Management Science , volume=","venue":null,"work_id":"48bf6cef-4b5b-4307-b197-adb440921cb0","year":1960},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.216330Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:76037c7b97d299469331f9ca363d147b5a53ea0593ed02f4f53f2d4cae4fd145","observation_id":"6e37de10-0d89-4b1f-9ee2-0020d2a73ecb","resolution":{"observed_at":"2026-08-15T14:55:09.599466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.581572Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"f2ad36cb-65c6-42a7-8972-f3c6338c0714","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.220442Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:069e2bad31912893d38096c54f9ed19adb2022d22f898816ac2eb388c12c397c","observation_id":"793181da-0760-4d5e-8f41-477c508bff64","resolution":{"observed_at":"2026-08-15T14:55:09.586557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.563947Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"081cd273-0996-4010-b3ac-127deb516b33","year":2019},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.224838Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:9c50c8152e786ecb738fb91bdeec72621789ff6d99433477952514d173261031","observation_id":"0b4bfb09-a9af-4267-83ed-cacfa5d216dc","resolution":{"observed_at":"2026-08-15T14:55:09.570798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.03787","last_updated":"2022-02-16T10:01:00Z","snapshot_observed_at":"2026-08-13T19:08:26.924751Z","submitted_at":"2021-06-07T16:51:07Z","title":"Concave Utility Reinforcement Learning: the Mean-Field Game Viewpoint","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.03787","snapshot_observed_at":"2026-08-15T14:55:08.228980Z","title":"arXiv preprint arXiv:2106.03787 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.228980Z"},"links":{"cited_paper":"/paper/2106.03787","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:286dd0118b2d44665d7409f4292a1cf037025d39119da5fba09fa744c5ea0e55","observation_id":"906ee949-2eb1-4dcc-9d49-aa9a43135642","resolution":{"observed_at":"2026-08-15T14:55:08.228980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.233508Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.233508Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:01557d899f9f4ce778628a407bf10da725a18e13daf3aca2a5ea0cc3fd03aa9d","observation_id":"8533771a-9da8-439e-b4b4-b2936fd3346f","resolution":{"observed_at":"2026-08-15T14:55:08.233508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.540024Z","title":"Part I: Theory , author=","venue":null,"work_id":"86cb0ad5-17ec-4768-bc9a-ab225343f0cb","year":1994},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.236947Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:a6ca11349ddb376f90bd1719c8341b33a6fc0561ec5e2580bf9cbda1549b60bf","observation_id":"54c6524b-5252-4e7e-971e-5452d46924da","resolution":{"observed_at":"2026-08-15T14:55:09.544980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.526668Z","title":"Mathematics of Operations Research , volume=","venue":null,"work_id":"c7d9b1f6-6a3d-4bcb-a3fe-b6504d8b7d3d","year":2002},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.240622Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:ccdee320bb5d3a5c0969cc85e863790e37fd5eb5282f034a9340e4a3d5ddd7b9","observation_id":"f0733a45-46e3-48f5-bc40-354a7f9ab3b2","resolution":{"observed_at":"2026-08-15T14:55:09.531163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.511373Z","title":"IEEE Journal on Selected Areas in Information Theory , volume=","venue":null,"work_id":"3ff35909-2063-4ba1-a66e-85a8babcb218","year":2021},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.244582Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:48676a0d5f078b605586f91394ca5e0df9b07f90475028ecad7963f58c536d9b","observation_id":"f6c0f7b1-301f-4be2-84a5-85eb59cb4725","resolution":{"observed_at":"2026-08-15T14:55:09.517460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.248899Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.248899Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:d9c99d3e348d6b11866f0dc76a577ff0e02d693bcb1cdd36c73bcf820cc79874","observation_id":"bba587a3-5ac2-4445-bde0-8c9ad2cffaa8","resolution":{"observed_at":"2026-08-15T14:55:08.248899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.252789Z","title":"2018 IEEE international conference on robotics and automation (ICRA) , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.252789Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:798c8635a69d649befd7f075efb8cc56992634c3018fd2dcd8411f5e4eadfe8f","observation_id":"25c9fd27-b18a-4f1f-acbf-36d6ce087494","resolution":{"observed_at":"2026-08-15T14:55:08.252789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.470424Z","title":"Management Science , volume=","venue":null,"work_id":"8805feb8-3358-4a58-8ebc-f8795c05695f","year":2007},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.256758Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:94fd2130a5c9fa1c37b13e962e64879da77e617bda6cef3d85622283cddc396c","observation_id":"aa160ddf-7674-4474-9c42-9c9fe79bd644","resolution":{"observed_at":"2026-08-15T14:55:09.475061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.456659Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":"44f830d9-76a2-4749-9c7a-ad59e39aa3d4","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.260505Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:6c14c2065d35577515f473d25cc109a34590b365d85500365e7b52200a23daf0","observation_id":"12d1a7bf-936c-4762-9fca-bf2f77354992","resolution":{"observed_at":"2026-08-15T14:55:09.460777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09992","last_updated":"2024-02-15T14:55:38Z","snapshot_observed_at":"2026-08-16T14:18:17.539481Z","submitted_at":"2024-02-15T14:55:38Z","title":"Risk-Sensitive Soft Actor-Critic for Robust Deep Reinforcement Learning under Distribution Shifts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09992","snapshot_observed_at":"2026-08-15T14:55:08.264749Z","title":"arXiv preprint arXiv:2402.09992 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.264749Z"},"links":{"cited_paper":"/paper/2402.09992","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:95d4c7544ea42bb84ce5693f37165be8f13301746d83d92b5ecdc50dd7b0755a","observation_id":"85dfabbc-1197-4bb3-9633-f0d45ce16338","resolution":{"observed_at":"2026-08-15T14:55:08.264749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.270175Z","title":"Neural computation , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.270175Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:d92ab2a5ea7e385359dc7e607184765cee6e25d9e9db65ff4e30abc0b4840c73","observation_id":"3d8b80cc-31a3-44d6-bcc3-cd1f31cbab59","resolution":{"observed_at":"2026-08-15T14:55:08.270175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.434786Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"8b9c925a-ec34-43ef-bf1a-73694ef4d8e6","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.274592Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:fe62d53ad44c24650e25ca1c18ecf97bd9d325ff0b3327ceec84e29554ff536c","observation_id":"ce62528e-1280-4e94-b415-6cf00ce39ed6","resolution":{"observed_at":"2026-08-15T14:55:09.439351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.278796Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.278796Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:5b6198d4134ce778cac42b4ae537a43459092b46d70951d95bd786a31372cde6","observation_id":"df803e70-b627-452b-aa69-62d36d57b32d","resolution":{"observed_at":"2026-08-15T14:55:08.278796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.415755Z","title":"2025 , url=","venue":null,"work_id":"1564a5fb-e746-410f-a7d4-b29272be6044","year":2025},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.282938Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:13df7c1d864c7bac795e614bcce0bce41faac1d9afcc6a269bcab8881066fc4b","observation_id":"3b0648ce-3020-4fdb-b4f4-05378a1a4b20","resolution":{"observed_at":"2026-08-15T14:55:09.419546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.04108","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.913019Z","title":"arXiv preprint arXiv:2410.04108 , year=","venue":null,"work_id":"f35e267f-a322-44ee-b8a5-4d64a4f7f568","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.287184Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:cbc6bf9c99bb85a751ed6ae137da903768bd4042a9e64e688a011fb1e31ec43e","observation_id":"f853b98f-e23f-4cda-941f-a7f11a4f4e1a","resolution":{"observed_at":"2026-08-15T14:55:08.919964Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.404250Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"0ce16b4e-a16b-4060-a89c-fe945132307b","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.291302Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:1bf2028b2b674f1178b22742fc02d195d512f37edca363d30f6294bc754ffb10","observation_id":"b4ef6ba1-dc83-406f-b08a-f5be707b150d","resolution":{"observed_at":"2026-08-15T14:55:09.407992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13589","last_updated":"2024-12-21T04:11:08Z","snapshot_observed_at":"2026-08-16T14:41:04.718580Z","submitted_at":"2023-11-22T18:50:06Z","title":"Risk-sensitive Markov Decision Process and Learning under General Utility Functions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13589","snapshot_observed_at":"2026-08-15T14:55:08.295647Z","title":"arXiv preprint arXiv:2311.13589 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.295647Z"},"links":{"cited_paper":"/paper/2311.13589","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:7a215c3ae8a7ec3c707522fc8082e496932d6315852ec5749dc548a8e26a9540","observation_id":"53240f32-7cd1-40b8-b07c-be2f1b30bd4a","resolution":{"observed_at":"2026-08-15T14:55:08.295647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.392861Z","title":"2018 IEEE International Conference on Robotics and Automation (ICRA) , pages=","venue":null,"work_id":"2fbdc5fe-ae6d-4277-be9d-a85cc24f8d5b","year":2018},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.299925Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:f93245790d361d342c139e3726f990d30e56c93f00dc1e2576f2891807cb7c77","observation_id":"962cdb9b-30f3-491a-a42b-0b230d7f5aaa","resolution":{"observed_at":"2026-08-15T14:55:09.396705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-14T21:35:45.210326Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-15T14:55:08.303601Z","title":"arXiv preprint arXiv:1610.03295 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.303601Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:00e3e229df15afae288e62ac2fcee2d0563811ec950383eb49498d39d8a534eb","observation_id":"ed61019b-f4d5-4406-ad8c-2fbcb0431db0","resolution":{"observed_at":"2026-08-15T14:55:08.303601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.380859Z","title":"2020 IEEE International conference on healthcare informatics (ICHI) , pages=","venue":null,"work_id":"0b4cb4b1-e1da-4732-82cb-cd52e7e0bf27","year":2020},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.308127Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:554cbb2ffd34c6f680758e562985e8655c0b46de737027adde8412e80bdbe760","observation_id":"9d1690e2-77b4-485d-aa51-0b8795b6f4df","resolution":{"observed_at":"2026-08-15T14:55:09.384840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.312020Z","title":"Mathematical finance , volume=","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.312020Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:4abfa279124b5dfcc9e98d7d00b6db6a8a8f29e04c0103f4727502a9cb860f39","observation_id":"c2f17864-ae7e-4ada-a011-bd5fcd9bec69","resolution":{"observed_at":"2026-08-15T14:55:08.312020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.316750Z","title":"2024 , publisher=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.316750Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:539b781a56bcd5f32dbf8627e840387d1217c83b196f394e20c622147f209130","observation_id":"6726b5e7-a5aa-4474-ac32-bb5656416a54","resolution":{"observed_at":"2026-08-15T14:55:08.316750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.350666Z","title":"Grimmer et al","venue":null,"work_id":"1dbbb1e0-c622-40ab-a995-dfea7866e511","year":2023},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.322520Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:050c8dceae6d7524c1a60155358bc6d36b2fe60651a6714b88963724f940791b","observation_id":"7d88bae7-445a-4340-a579-77d3921edd76","resolution":{"observed_at":"2026-08-15T14:55:09.355964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.337805Z","title":"INFORMS Journal on Optimization , volume=","venue":null,"work_id":"eae4c6f0-ebe5-411d-8b45-866334762e5a","year":2024},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.326667Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:104f6cfd80624e970ce569fdf7fc45196dc62041b6257740160b7d492b397e07","observation_id":"29c13d58-bbf4-47fb-a368-18df72b11b79","resolution":{"observed_at":"2026-08-15T14:55:09.342169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.330660Z","title":"Matecon , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.330660Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:ccad358b4b07682df9c27cd079d4b1aeab1e9b139f7a2c267fa900aea13015e1","observation_id":"16a554f5-8fa0-4f3c-9646-4a0353a5e8cc","resolution":{"observed_at":"2026-08-15T14:55:08.330660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.335004Z","title":"Mathematics of Operations Research , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.335004Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:25af4deba1c1d08a3ac582cb0f8aeebc7ed38bdaac3fc036973c9bcfe7937712","observation_id":"40b2b2d1-ee2c-4878-b29f-1e9af24f3d90","resolution":{"observed_at":"2026-08-15T14:55:08.335004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.339178Z","title":"Mathematics of Operations Research , volume=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.339178Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:7cff9b2550f23c89e32c335f0aa9a370e6c6447c89c3abcbaa5a06c9af5959f5","observation_id":"2ae9ef16-3442-444e-8323-46b160b13de9","resolution":{"observed_at":"2026-08-15T14:55:08.339178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1206.4643","last_updated":"2012-06-18T15:19:07Z","snapshot_observed_at":"2026-08-16T11:47:01.971177Z","submitted_at":"2012-06-18T15:19:07Z","title":"Lightning Does Not Strike Twice: Robust MDPs with Coupled Uncertainty","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.4643","snapshot_observed_at":"2026-08-15T14:55:08.342949Z","title":"arXiv preprint arXiv:1206.4643 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.342949Z"},"links":{"cited_paper":"/paper/1206.4643","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:ae9ae0e7a2f9cdd0479ad35c18b057f53a4fe82cc9e0a071d5da21c4f8bf92d0","observation_id":"ad3a563f-b03f-4948-8cd4-f92f4d5fbb19","resolution":{"observed_at":"2026-08-15T14:55:08.342949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15360","last_updated":"2024-10-16T14:56:15Z","snapshot_observed_at":"2026-08-16T13:17:39.160528Z","submitted_at":"2024-09-18T02:35:41Z","title":"Reward-Robust RLHF in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15360","snapshot_observed_at":"2026-08-15T14:55:08.347331Z","title":"arXiv preprint arXiv:2409.15360 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.347331Z"},"links":{"cited_paper":"/paper/2409.15360","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:50db39de59143865ecaad86519ae5183bbac11eb4636e9a25013981571140d9d","observation_id":"54b01754-a1cc-4854-a647-b298e0e23486","resolution":{"observed_at":"2026-08-15T14:55:08.347331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.298934Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":"b5d405e5-0e62-46a8-af7f-f7af4b15671f","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.351646Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:78c1ecb648b64886fe530b93c9816a923f18a743c84764dc6157f862ed91e667","observation_id":"6ae00c1f-7dd4-4aaf-9269-0af9a6cdd6ee","resolution":{"observed_at":"2026-08-15T14:55:09.303307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.286489Z","title":"IEEE Transactions on Artificial Intelligence , volume=","venue":null,"work_id":"2b19c020-1fee-45c4-a115-25faae2241f7","year":2023},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.356152Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:1b21d4ac42abd15b5c1ca7f5c239bf0cf4667b18819661e1d457dbec2e040c02","observation_id":"1df83a5f-b9da-4b12-a373-0ef590a350a4","resolution":{"observed_at":"2026-08-15T14:55:09.290910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.359813Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.359813Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:5a3c18d98a2e928e2d4195e0327302e047f06c10316d911380c6e4d7c5fed1a7","observation_id":"3f237934-bf74-4f5e-b078-41309c46a7be","resolution":{"observed_at":"2026-08-15T14:55:08.359813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.263205Z","title":"Mathematics of Operations Research , volume=","venue":null,"work_id":"b6de59cc-8607-4962-99bc-40a5b6167582","year":2016},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.363941Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:cd895885b853d320de71f2025f156a2e17d8bdec14dd352f511eafdcf4ce90a3","observation_id":"e282be8a-e03c-4f51-83b8-507bcad12415","resolution":{"observed_at":"2026-08-15T14:55:09.267598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.249264Z","title":"Mathematics of Operations Research , volume=","venue":null,"work_id":"0f802b7f-1ae6-40cf-911c-e1a13df53d72","year":2023},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.368322Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:c0e781fd597360a4a1cca1fd2ccd3fcd7d6a49a617a1b5a7d26d96994a067961","observation_id":"02720ae5-3afc-4e01-9b68-f66102e260f8","resolution":{"observed_at":"2026-08-15T14:55:09.254815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.236913Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"d62c20ce-c412-4ee5-884a-9b78027d282f","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.373156Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:5176bd1dd455838595a79b0549ed61bfd063defc8e8e79a321910d2603871c6d","observation_id":"e224d4b8-82a8-4952-97ba-b1cdbfedfa50","resolution":{"observed_at":"2026-08-15T14:55:09.240858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.377432Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.377432Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:6b1eee970615e4002c0aeff872bda97bd1ebf3ee021ae2bcd09938083041f0a9","observation_id":"3670e33a-7903-4d57-8a53-99b8e85088e3","resolution":{"observed_at":"2026-08-15T14:55:08.377432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.216203Z","title":"2001 , publisher=","venue":null,"work_id":"6b00bc34-e551-43a5-bda9-d76f3b7982dc","year":2001},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.381278Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:a82ff28956f3831de4f4c14d1867aa81dd3a1bc3af482305f4d91be9ba325eea","observation_id":"a2bd21c5-04af-43f3-8ef9-6486ca9aac40","resolution":{"observed_at":"2026-08-15T14:55:09.220311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.203516Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"591733c1-a4d1-417c-b5dc-3df5190b671d","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.386507Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:43f08e925fa6a358b983d37aafd9c7e8959274051172f5e8000905d7654ca266","observation_id":"e9b2c572-9e8b-4e6b-8f94-375c322e160b","resolution":{"observed_at":"2026-08-15T14:55:09.207867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20359","last_updated":"2025-05-29T13:19:08Z","snapshot_observed_at":"2026-08-13T21:12:31.584269Z","submitted_at":"2025-05-26T08:01:37Z","title":"Risk-aware Direct Preference Optimization under Nested Risk Measure","version":2},"cited_work":{"arxiv_id":"2505.20359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20359","snapshot_observed_at":"2026-08-15T14:55:08.730325Z","title":"Risk-aware Direct Preference Optimization under Nested Risk Measure","venue":"cs.LG","work_id":"f4132d16-e3b6-49e9-9992-b95e0e20188b","year":2025},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.391303Z"},"links":{"cited_paper":"/paper/2505.20359","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:e9e100cce736c209b867d1cd61b53493f9ae7e8f4ddfa0bda7423d53faec3a82","observation_id":"e2956207-a52c-4bb9-964e-2499182d6341","resolution":{"observed_at":"2026-08-15T14:55:08.738163Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.20726","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.708510Z","title":"arXiv preprint arXiv:2511.20726 , year=","venue":null,"work_id":"d0363e8e-fd76-4d5f-b3cf-565eac007b02","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.396291Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:b3f71beec6a78d7d5add9e03567615f84b995021442fd63085e242f56e6a9889","observation_id":"e1bd5064-5889-4650-82b4-0f34205b91c9","resolution":{"observed_at":"2026-08-15T14:55:08.715866Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1206.6404","last_updated":"2012-06-27T19:59:59Z","snapshot_observed_at":"2026-08-15T00:55:10.848929Z","submitted_at":"2012-06-27T19:59:59Z","title":"Policy Gradients with Variance Related Risk Criteria","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.6404","snapshot_observed_at":"2026-08-15T14:55:08.400325Z","title":"arXiv preprint arXiv:1206.6404 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.400325Z"},"links":{"cited_paper":"/paper/1206.6404","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:0197db5a788843762e984fb4e2c7b5795fb43350fc81c55e2958ee5ba24f34a9","observation_id":"bcc31a39-b225-43ab-95cc-5880f4c09989","resolution":{"observed_at":"2026-08-15T14:55:08.400325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.404889Z","title":"Journal of risk , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.404889Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:e7ad158f6a013eb9545e0b3a0bc474b7cc104b4c6ce21e0d847f5c8498c3c23d","observation_id":"f7dcdd42-5db6-4661-809c-63a97812504d","resolution":{"observed_at":"2026-08-15T14:55:08.404889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.182946Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"a5d0fda9-bbdb-4d91-bf1e-25be65f71466","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.408802Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:65adb7979172e7b907ad542785dcef8f05345200a08ec21cf97e74a8f06a75a5","observation_id":"fb155e9b-8345-45c5-adc4-59de326365a3","resolution":{"observed_at":"2026-08-15T14:55:09.187132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.170809Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"73d36227-cd49-4440-9c08-db7907c28fc8","year":2023},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.412921Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:c7e836f1edad955f999fdb7671c81d89dea338c5929183498c1565aa66197951","observation_id":"5e44678c-9994-4774-90ae-f0837ff3c72e","resolution":{"observed_at":"2026-08-15T14:55:09.175148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.416900Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.416900Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:122de70a0be856ed610d68fde171d42b9e64907df910d36ba7fb2efaa81846ae","observation_id":"1fe60b06-9501-4777-84ff-0180826db80d","resolution":{"observed_at":"2026-08-15T14:55:08.416900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.146701Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":"aad30310-237b-4369-a06a-d89e9a97cd0c","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.421479Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:2de55b3c2d3185b633033e99d32ff17140212de5c8b20f276c94135f53260f14","observation_id":"3554b77a-790a-40c7-9691-a58cda2a5d29","resolution":{"observed_at":"2026-08-15T14:55:09.151767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.132156Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"366f0b2a-3510-40a3-838d-7dcc726192a4","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.426481Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:a7b28baaf443ade530292d5df9aa34d7f5dedff202a7dc5b0c9aa04be36cdfae","observation_id":"e248cd1c-0504-4680-8554-4213a891d297","resolution":{"observed_at":"2026-08-15T14:55:09.136626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.118419Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"000d33b9-84e5-4569-8f96-ed88e39627f1","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.430350Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:8aae070fc6b00c41f978c1ba9323fd538d76be0b1aa71f5b813507e21a3cabb8","observation_id":"19ef29d5-c961-4ee2-9fd7-a9f21d2ef46c","resolution":{"observed_at":"2026-08-15T14:55:09.123395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12773","last_updated":"2023-10-19T14:22:03Z","snapshot_observed_at":"2026-08-14T19:10:00.850271Z","submitted_at":"2023-10-19T14:22:03Z","title":"Safe RLHF: Safe Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12773","snapshot_observed_at":"2026-08-15T14:55:08.434791Z","title":"arXiv preprint arXiv:2310.12773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.434791Z"},"links":{"cited_paper":"/paper/2310.12773","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:065968c9d179d8bd1952ff0893d2c614598300e672841c1bbc11f6a95a193431","observation_id":"20aeb236-e07e-434e-a83a-1eb20485db9e","resolution":{"observed_at":"2026-08-15T14:55:08.434791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.439592Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.439592Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:fd4405207104aebbce0fd4446bbba94605809c85a1fec658bee1633b12c88ffc","observation_id":"74f1b72d-9626-4aa2-a0ff-2cb106c813c6","resolution":{"observed_at":"2026-08-15T14:55:08.439592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.098921Z","title":"1997 , publisher=","venue":null,"work_id":"dd32c79a-bec5-444d-923a-155b13cc96e0","year":1997},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.443777Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:47b0f582fef2ce5b79f3f5c1fff62cf946e6d4902921ade46f6e405d1f7f9d76","observation_id":"519141a6-e25f-486f-bd85-fa702c457c1c","resolution":{"observed_at":"2026-08-15T14:55:09.102833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T14:55:08.447778Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.447778Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:fedc2b26ad40523867c940f12cdeb3bd958bbebb206c34f6ae7ecfaafdf4dbe2","observation_id":"c248e089-96c9-4f2c-a525-9d2aa528ca4a","resolution":{"observed_at":"2026-08-15T14:55:08.447778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.452271Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.452271Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:1305c90d16177a4fc1abefc8682e2e1684d8d3c4af01e77ee7118119a965c5ba","observation_id":"4eefc245-5408-4c5d-824c-b50b015b0262","resolution":{"observed_at":"2026-08-15T14:55:08.452271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.077092Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"d3ef34e2-bddd-4115-90b4-50e84bba59b4","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.456542Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:06132730253899f6ec7495e9e76ba023741e62a7009ebc45af475ff1f685991b","observation_id":"bffb2d5c-7713-47b1-9b26-681cf2ee0087","resolution":{"observed_at":"2026-08-15T14:55:09.082066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.460863Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.460863Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:1787224583ebd4847a9c47dd5863f9916a3c1383d8d30c3bc97b3b9731c984ee","observation_id":"69f76097-e903-4b08-8807-8c64910ad389","resolution":{"observed_at":"2026-08-15T14:55:08.460863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.056021Z","title":null,"venue":null,"work_id":"1a96efc7-58cf-4def-85a6-d9234c1abe92","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.465054Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:a4b0388567c01a8f0db9b9a73f65fa7f80085cda25a30b29edca62acc2e2ce9f","observation_id":"63a9ef1a-325a-4a92-ad7f-2a8c21d77b3d","resolution":{"observed_at":"2026-08-15T14:55:09.060129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.469615Z","title":"Machine learning , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.469615Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:419c906e93fa4b58a789a51592baa0480327ebcb6418b5603420531dc03c3afb","observation_id":"893badf8-8cda-4294-a474-d1edce9b8135","resolution":{"observed_at":"2026-08-15T14:55:08.469615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.035248Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"32e58f56-015c-46b1-8ded-024ac6b4bade","year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.474143Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:500b9cbb2c99e70c7a220dae509dc868ddbfbd30b96a9a82478091b586b3a9c8","observation_id":"443f86df-948e-45c0-96e7-6c2c87f8a65c","resolution":{"observed_at":"2026-08-15T14:55:09.039510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.022437Z","title":"Sbornik: Mathematics , volume=","venue":null,"work_id":"319de402-06f0-421e-a126-c7a94f4579ee","year":2020},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.478166Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:6d94a71382d3f70cd9d2218bc8c5ba6d64d1428e67c61785f80bd41812cf4718","observation_id":"9b37d7c5-e21d-4920-9392-6e3d089bac70","resolution":{"observed_at":"2026-08-15T14:55:09.027022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:09.008949Z","title":"Journal of Mathematical Analysis and Applications , volume=","venue":null,"work_id":"0113a8e4-43ae-4f61-9446-20b08f830a65","year":2019},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.481938Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:486a3dfc89310e8ae4faf1f53adf5691471e63f46fdb18064c676f20e3e7f1a5","observation_id":"be66bef6-014b-4e6f-b38b-98741ef8c7cd","resolution":{"observed_at":"2026-08-15T14:55:09.013508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.995137Z","title":"Journal of banking & finance , volume=","venue":null,"work_id":"e43a5a44-fefb-4384-9a7c-b1a614c5f4bd","year":2002},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.485550Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:e793c882e1c0c7a04bced9937bd02634e8540008dbfeb6b62fb89fc692f28f13","observation_id":"621a96a8-4d22-4b86-9691-d8601861da66","resolution":{"observed_at":"2026-08-15T14:55:08.999415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.489093Z","title":"arXiv preprint arXiv:2503.03064 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.489093Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:f0482004fa1fff37f7a0b1539bb58d612d9c3d4bc5e11cca5e3be7a600e3ee59","observation_id":"0eed2b43-75f0-4175-8012-afa3c0d5c2c2","resolution":{"observed_at":"2026-08-15T14:55:08.489093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03096","last_updated":"2023-05-14T20:11:20Z","snapshot_observed_at":"2026-08-16T16:26:20.509607Z","submitted_at":"2022-10-06T17:50:42Z","title":"Accelerated Single-Call Methods for Constrained Min-Max Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03096","snapshot_observed_at":"2026-08-15T14:55:08.492703Z","title":"arXiv preprint arXiv:2210.03096 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.492703Z"},"links":{"cited_paper":"/paper/2210.03096","citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:41f6259b6665d5b270e5a2e036d3d7e29fb08906d804b1e5d0710a9602351fef","observation_id":"9eb6ba9c-91d6-4160-974b-d311f783afe7","resolution":{"observed_at":"2026-08-15T14:55:08.492703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.496358Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.496358Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:249010fe5d51e0343c3fe645f1aedf0c8e04661c19222d1d4cd444d2dff4d3b1","observation_id":"eedf9b09-1b65-4e73-afaf-e132cc0fb12f","resolution":{"observed_at":"2026-08-15T14:55:08.496358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.499668Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.499668Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:66b933c572ef5753af0ce21c2258eb2f09f3a3e98b7d0af80a8a1054c0040335","observation_id":"82fd8b11-0b6c-45cf-a06d-46fcb44b5797","resolution":{"observed_at":"2026-08-15T14:55:08.499668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.503405Z","title":"Stochastic Systems , volume=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.503405Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:52072924c61c19a4abccebb476cd17fb8dae3bc188d8996f8469053fccd9e8a8","observation_id":"c2cd7c48-6661-4441-984b-2e3e1f73ae39","resolution":{"observed_at":"2026-08-15T14:55:08.503405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.953540Z","title":"Mathematical programming , volume=","venue":null,"work_id":"606bf557-4a94-4f2c-a24d-50bb72724dd4","year":1992},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.506870Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:0518ff03b915a8ba85222117445e980e49bcc3b6eebf70cf6e88a8b59ece88ec","observation_id":"353ec410-a9d3-40ea-a9d8-f49842cfdca2","resolution":{"observed_at":"2026-08-15T14:55:08.960064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.940538Z","title":"Mathematical Programming , volume=","venue":null,"work_id":"760e0edd-b641-442c-9d4a-333f51c5dfcf","year":1994},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.510638Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:ee3aeaf4a7d20042fb9df53de1530ddb836f5f6db680417f46993b895f47165f","observation_id":"8e7566b4-b970-465e-9163-b87d27afdbda","resolution":{"observed_at":"2026-08-15T14:55:08.944964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:08.514467Z","title":"Convex analysis and monotone operator theory in Hilbert spaces , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-15T14:55:08.514467Z"},"links":{"citing_paper":"/paper/2608.03562"},"observation_digest":"sha256:a53c2122fb94c3d97fa5198189d6101532078aecf0d1efcd637bd3b6cc765885","observation_id":"cc07fb94-fec1-49e9-9bf1-b62b52d29b07","resolution":{"observed_at":"2026-08-15T14:55:08.514467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03562","last_updated":"2026-08-04T12:28:39Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T14:46:44.692808Z","submitted_at":"2026-08-04T12:28:39Z","title":"Robust General Utility for Reinforcement Learning"},"reference_resolution":{"displayed":96,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":54,"verified_exact":2,"verified_fuzzy":37},"total_outbound_references":96},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 96 of 96 outbound references and 0 inbound Pith citation observations for arXiv:2608.03562."}