{"as_of":"2026-08-21T18:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83cd73f8bbe0b2f08c2592b27574691877a4c3872bb2ce8f3e5dfd537eb065f0","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:52:42.597013Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02619/citation-record","integrity":"/paper/2502.02619/integrity","json":"/paper/2502.02619/citation-record.json","paper":"/paper/2502.02619"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:43.054792Z","title":null,"venue":null,"work_id":"e2ffc02d-a09a-4753-81dc-bf0b9fd878d8","year":2017},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.451514Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:6b105aea7f8ae0864b628d5f8531b0b279d970a5cba8c5ec6827f24264e44059","observation_id":"d75b1230-7c2f-427c-a3ac-950da82b4029","resolution":{"observed_at":"2026-08-09T12:52:43.058221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:43.046169Z","title":null,"venue":null,"work_id":"47a73196-2a60-4755-b36d-701d8820839a","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.455751Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:dac17454415b4260b1987df2e9187a2e205f37b21e7230bc56e60f04dfbeaaf9","observation_id":"a244a44d-907e-4826-9729-fee408baa35f","resolution":{"observed_at":"2026-08-09T12:52:43.049262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.459404Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.459404Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:25787bb72dfc40dec7b679f38600ca3b0967a2bb9cb6c4b7e3c5fa12e35e7616","observation_id":"898debbc-6d11-4cbb-a1b3-ebabc944ffa8","resolution":{"observed_at":"2026-08-09T12:52:42.459404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:43.033088Z","title":null,"venue":null,"work_id":"c9436446-fdc3-4ac4-84ab-96fb94e1dcef","year":2021},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.462933Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:43c0414b65b3c370dd133c2e71935f75efabdf3c7d554cabb39da10f8689397d","observation_id":"2a51b0b1-7d80-451b-9f91-a25b02e86840","resolution":{"observed_at":"2026-08-09T12:52:43.036044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:43.024976Z","title":null,"venue":null,"work_id":"ace1cfa9-cb5a-4ba8-a838-3141b8a2d9f5","year":null},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.466551Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:5cfbc8dec1ffe41c880fb8e47025985a5967223a422e7e31a5f9f4c6f5396d76","observation_id":"69b08761-0c33-4ac8-849b-0fefd63f38bd","resolution":{"observed_at":"2026-08-09T12:52:43.027988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:43.016878Z","title":null,"venue":null,"work_id":"d2c464b1-9182-45f1-a64f-2c50abdd6bcf","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.474020Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:7362148331b6a271d1fb9a005c368fabae3d15065571c028d58b46ccc61045f8","observation_id":"ca42f368-2f37-4abd-891f-bd2c840819a7","resolution":{"observed_at":"2026-08-09T12:52:43.019803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:43.008223Z","title":null,"venue":null,"work_id":"097c4917-6efb-4085-880f-6d51807211f9","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.477421Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:98410970ffaf69f876d19018ba701b6c9627f4af6ab912528faff8be28a688f5","observation_id":"f2123caf-c6e9-4038-a157-c3a995d2320b","resolution":{"observed_at":"2026-08-09T12:52:43.011247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.999711Z","title":null,"venue":null,"work_id":"188e4ea1-612d-4942-a586-9ebf26472405","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.480572Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:f4eec1b1a8a8396a4974baceb7dcd37b90375da3be1f2ad7391a01cb863c0fe2","observation_id":"21320991-5995-464d-b363-f78e8e3fcc16","resolution":{"observed_at":"2026-08-09T12:52:43.002856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.990923Z","title":null,"venue":null,"work_id":"2af049c5-95ff-4b73-bdf8-e3f3917b9fa6","year":2022},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.483931Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:ffeb7d49d486391a9b68cb142ce29e08970bbdad08fabb173367014a36b887bd","observation_id":"d53d6cd7-e91e-4dcc-8657-4f874b3f2e3e","resolution":{"observed_at":"2026-08-09T12:52:42.994262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.982321Z","title":null,"venue":null,"work_id":"123f4ffa-2a0c-4b4b-bef5-9e7cec3f98a7","year":2005},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.487133Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:ccf17b9ac42fab03e1d316a64ed485edd3964b2c24a8c747a650037118af1d1c","observation_id":"0937de1a-1a26-4fcc-a343-1263d1aa51ca","resolution":{"observed_at":"2026-08-09T12:52:42.985344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.973672Z","title":null,"venue":null,"work_id":"e28b5848-9012-4a77-8ef4-abf43b6e5941","year":2024},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.490503Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:2473ad4d48c5cf0af5772b023f18e3e7b59c7b4066b6f2ec625f8caf53d9e1f2","observation_id":"b55ff14b-abc6-49f3-98d5-79323aa886f7","resolution":{"observed_at":"2026-08-09T12:52:42.976825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.964823Z","title":null,"venue":null,"work_id":"7cf132fb-2f80-4218-a0c6-fb092aafbce1","year":2011},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.493821Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:49fb7d5a0f33488d6d50eb0ec2fce501825288b6e784366e5439088ef9d0074d","observation_id":"fef491cb-1c7c-4e5b-8f8d-21f136fb6ce7","resolution":{"observed_at":"2026-08-09T12:52:42.967918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.955851Z","title":null,"venue":null,"work_id":"cd7cd5cd-bbb0-4124-b993-b59670e3ea6d","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.496917Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:539320bab591863a7f870df7ee8f64bbcb30cda1f0e0feaa5cc0932e5cb81ba7","observation_id":"f2fbbfae-cfe0-4940-9477-f13db11c25a9","resolution":{"observed_at":"2026-08-09T12:52:42.959095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.946733Z","title":null,"venue":null,"work_id":"26088f42-1c57-4ad8-a45e-3abc02086f8b","year":2018},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.500005Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:ef93efa859e8ffdc42801d8721b51c13913eda120cdb1b8d36688eda01479a92","observation_id":"3c3fb25a-874f-45e5-9881-16be6504df52","resolution":{"observed_at":"2026-08-09T12:52:42.949939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.937540Z","title":null,"venue":null,"work_id":"cf517137-bcdd-45ea-b066-3a1296d4c9e0","year":2009},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.503088Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:ea2b035b48923316289d2c91a548e5139c87ce66610625f76a115f259dfc3163","observation_id":"7512bf41-991f-4594-a62a-146223012a6f","resolution":{"observed_at":"2026-08-09T12:52:42.940700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.928656Z","title":"predict, then optimize","venue":null,"work_id":"8facf914-48de-42b7-8102-3551e9e89c4f","year":2022},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.505984Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:5e1565644ed3a186abe45517be882b38cb521ede4bb52db67761da7162a9d00f","observation_id":"ed9f693d-f8d0-4594-a052-f684586d0690","resolution":{"observed_at":"2026-08-09T12:52:42.931812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.11248","last_updated":"2018-08-13T18:33:24Z","snapshot_observed_at":"2026-08-14T20:18:41.596978Z","submitted_at":"2017-10-30T21:22:28Z","title":"Learning Robust Rewards with Adversarial Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.11248","snapshot_observed_at":"2026-08-09T12:52:42.509241Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.509241Z"},"links":{"cited_paper":"/paper/1710.11248","citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:78a2b76095e3569cc21226197b474585e8be3c594c3871675c9960c18e4f4b92","observation_id":"e8e71db5-723b-4cd6-a706-54d3db6846b7","resolution":{"observed_at":"2026-08-09T12:52:42.509241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.919375Z","title":null,"venue":null,"work_id":"98683e25-0709-41a0-9a13-5c4c2048b25d","year":2012},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.512607Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:a6b5bfe2917a1d7a58d227fecd34bdaf69f4b39c6dc5468b29d25b268f6b1056","observation_id":"922c96ab-5111-45d0-ae62-06fd636c54dc","resolution":{"observed_at":"2026-08-09T12:52:42.922836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.01874","last_updated":"2022-01-06T00:08:17Z","snapshot_observed_at":"2026-08-21T15:15:28.653941Z","submitted_at":"2022-01-06T00:08:17Z","title":"Combining Reinforcement Learning and Inverse Reinforcement Learning for Asset Allocation Recommendations","version":1},"cited_work":{"arxiv_id":"2201.01874","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.01874","snapshot_observed_at":"2026-08-09T12:52:42.728627Z","title":"Combining Reinforcement Learning and Inverse Reinforcement Learning for Asset Allocation Recommendations","venue":"cs.LG","work_id":"4609e5f5-19c0-40b6-ac49-89740eb8b899","year":2022},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.515769Z"},"links":{"cited_paper":"/paper/2201.01874","citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:b834e7463a963716db0e9c51ec15ca47a4da856b77e1285e719d46a9fa44222d","observation_id":"7f459e03-294e-48b0-a7eb-62a70dcba109","resolution":{"observed_at":"2026-08-09T12:52:42.732246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.910642Z","title":null,"venue":null,"work_id":"eb731a04-25cd-4902-9116-4696d0f0d0e7","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.519833Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:3c4b7b968f83e00d683ece5d16841d18d00f4c003d846db70370f0070d15fcc2","observation_id":"5cf9ffa0-0880-4fb5-b4b4-35ae272d677b","resolution":{"observed_at":"2026-08-09T12:52:42.913748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.523084Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.523084Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:27ec2c16062d9f243c29f426c7bd30b15df26bad7bb5c3efaa0fe0a04c57e53b","observation_id":"7e10fb1c-c0d4-4393-8274-50b5a0f1c58a","resolution":{"observed_at":"2026-08-09T12:52:42.523084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.10059","last_updated":"2017-07-16T10:29:38Z","snapshot_observed_at":"2026-08-15T21:44:03.561563Z","submitted_at":"2017-06-30T08:31:28Z","title":"A Deep Reinforcement Learning Framework for the Financial Portfolio Management Problem","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.10059","snapshot_observed_at":"2026-08-09T12:52:42.526251Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.526251Z"},"links":{"cited_paper":"/paper/1706.10059","citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:a03e32dfd1270a461f39b0945b1057e7d73169fc9e750c47c9e31c53b1c0c2d6","observation_id":"2a40518e-e336-4936-9e51-7ead578adac0","resolution":{"observed_at":"2026-08-09T12:52:42.526251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.896254Z","title":null,"venue":null,"work_id":"6e5543ae-9c09-4607-8148-69153105806f","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.529671Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:d3f17d2bc962380323dfbf90938e94b41ffa1a50ad163de28c6cb7b219621910","observation_id":"b6143a5d-bd43-404d-a25c-edaae35d326e","resolution":{"observed_at":"2026-08-09T12:52:42.899686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.887414Z","title":null,"venue":null,"work_id":"ebbbe218-6513-4385-8b72-371926bcf8ac","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.532617Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:81c442ed81e60ea9075bc640501e2328db36fd58f6ab0911c2eb09e1a2032e65","observation_id":"32cad49b-d948-4f66-918c-b8a200b8e56b","resolution":{"observed_at":"2026-08-09T12:52:42.890473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.878745Z","title":null,"venue":null,"work_id":"85594be1-ab52-49e7-a29e-365a6dbab437","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.535589Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:9fd219902c28b4558ad71731190487b3d4932a53f3b26a2387c508a234b724f2","observation_id":"5f514b05-b7f4-4b42-b339-9fbd4990c596","resolution":{"observed_at":"2026-08-09T12:52:42.881794Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07694","last_updated":"2025-08-06T02:38:08Z","snapshot_observed_at":"2026-08-21T17:07:42.320847Z","submitted_at":"2023-07-15T03:12:11Z","title":"Evaluation of Deep Reinforcement Learning Algorithms for Portfolio Optimisation","version":3},"cited_work":{"arxiv_id":"2307.07694","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.07694","snapshot_observed_at":"2026-08-09T12:52:42.708367Z","title":"Evaluation of Deep Reinforcement Learning Algorithms for Portfolio Optimisation","venue":"cs.CE","work_id":"c50cc51d-7bd2-4916-9a2c-adce34acaf96","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.538706Z"},"links":{"cited_paper":"/paper/2307.07694","citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:6dc9598a1f9e57b9751b0cd526f40fd6b1f6a59b242eb379a8a117a00447ab8a","observation_id":"f800ead4-2d1a-48a0-930c-1318f54c2fea","resolution":{"observed_at":"2026-08-09T12:52:42.712066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.869854Z","title":null,"venue":null,"work_id":"08c07efe-8721-401f-8d2b-06b93495421f","year":2019},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.542120Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:266ffb9eefbea10d5d550e623adac642d7c142874cef09c673f163d70b86de80","observation_id":"45d9f780-ea11-4b47-90f8-00132ad7c46f","resolution":{"observed_at":"2026-08-09T12:52:42.872922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.861162Z","title":null,"venue":null,"work_id":"0fded5bc-1935-411a-a60e-ac307f6f678b","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.545440Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:05f598ace163e08412ebb411a2e4158177fa24df127cdbdf7634ae91da4a28de","observation_id":"f5fdee2e-69b8-46aa-a18d-b7a995c24a9d","resolution":{"observed_at":"2026-08-09T12:52:42.864243Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.852107Z","title":null,"venue":null,"work_id":"a872c4d1-fcc0-495b-b3d1-08250999b077","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.548429Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:e4c740fce6532d3a14b7bca9059352b004a18b083212f8c55cb4cd6198be6cdc","observation_id":"50727468-2175-4e4f-aade-a22316403090","resolution":{"observed_at":"2026-08-09T12:52:42.855533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.551476Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.551476Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:8759dbbff9a0f79e96b5cdd3ef1ab315b5e91e2fc6d08872f69acd4f86dac1dd","observation_id":"7ca7b797-20c8-49e4-8eaa-f99f9dd478ad","resolution":{"observed_at":"2026-08-09T12:52:42.551476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.554559Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.554559Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:5e251ecdebe5c0ba5a0fbac5bd3c4b635bcf12952950eed71dd07c97ff98db09","observation_id":"2ca792d6-5c2a-49ce-9398-3c254234ec25","resolution":{"observed_at":"2026-08-09T12:52:42.554559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.838446Z","title":null,"venue":null,"work_id":"6048d886-1af2-4980-a2f9-91c3191419be","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.557499Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:c9d8d01f72ce74a36a670ab7b97ff957007d07555cb184d82cde23042e3a0fd2","observation_id":"db2da8af-92db-42f5-aaf4-f3bbd5254e49","resolution":{"observed_at":"2026-08-09T12:52:42.841699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.829353Z","title":null,"venue":null,"work_id":"8d968fe6-2bd5-441a-94c7-25a55a84de92","year":2024},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.560450Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:bc3f480ae10e863ea85b36819b05f87c7716ad327a120a19a2ab1ef09c6f5a97","observation_id":"2fd4189b-1448-42de-b14b-21cbd34722c6","resolution":{"observed_at":"2026-08-09T12:52:42.832432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.820511Z","title":null,"venue":null,"work_id":"232f35d8-9eac-4b3c-ab80-9faae80c43d3","year":2022},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.563377Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:229f13f020af70cee3a085eb959eadbdde4afd6e04edf0eb39c9a18def86a46a","observation_id":"7901c7b2-b491-4e70-9890-68c939a6f659","resolution":{"observed_at":"2026-08-09T12:52:42.823660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.811418Z","title":null,"venue":null,"work_id":"b80a634a-a0ac-4d18-b879-0cbeba299fbc","year":2015},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.566389Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:0327c483e2d998b9ecd836bead524fd585612ea4bf41efa8c82f5cd69815ef78","observation_id":"d057b9bb-a8cd-4651-8e25-121754fdb04f","resolution":{"observed_at":"2026-08-09T12:52:42.814829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.569705Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.569705Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:7d5742e0ce5fab3f9de933a54eea9d5003a71cd938e349c0e2bf65af05a3cc67","observation_id":"7437436a-4e91-49a7-b867-1e21331d8110","resolution":{"observed_at":"2026-08-09T12:52:42.569705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.797954Z","title":null,"venue":null,"work_id":"d933e176-5fca-4a8a-9e75-581a6ae7f10a","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.576538Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:67a73c191bfc4deb60a37084764d655531737891122128da3b9ab63d8eae0b64","observation_id":"a826f712-c6b6-4291-8c6a-14bf930ad95d","resolution":{"observed_at":"2026-08-09T12:52:42.801033Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.579511Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.579511Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:395424b5973ea83f3b8d50ee697eb09e71e5227bda20220d8d3a7fe79ffccf1f","observation_id":"484481d0-4662-4c3a-9f11-6ed515f73806","resolution":{"observed_at":"2026-08-09T12:52:42.579511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.783677Z","title":null,"venue":null,"work_id":"f5e208d4-9719-446f-abd9-c02b8d88f67b","year":2023},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.582652Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:ca82e84db7c2fe8e70fce4dee1eb328a717cfcbeeba13409af6520860b28b101","observation_id":"4495f5a9-96dd-42d9-b6f4-d74507be8954","resolution":{"observed_at":"2026-08-09T12:52:42.786914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04404","last_updated":"2020-10-09T07:25:55Z","snapshot_observed_at":"2026-08-21T17:55:04.504743Z","submitted_at":"2020-10-09T07:25:55Z","title":"Deep Reinforcement Learning for Asset Allocation in US Equities","version":1},"cited_work":{"arxiv_id":"2010.04404","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.04404","snapshot_observed_at":"2026-08-09T12:52:42.624452Z","title":"Deep Reinforcement Learning for Asset Allocation in US Equities","venue":"q-fin.PM","work_id":"5e7cedb2-0ff5-4d12-b511-7c6e042816ae","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.585819Z"},"links":{"cited_paper":"/paper/2010.04404","citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:34f695fc14ca8e0cd8dd624d30293fa6a9df5f2083676422f774a828f19c5123","observation_id":"4dde5196-21da-4ead-9d48-a5ec4a700ce4","resolution":{"observed_at":"2026-08-09T12:52:42.629950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.589239Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.589239Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:834704d4b5c841aa80ff3cb4590ce0d0aed476d8b83b6e8a3efac6998e2e3fde","observation_id":"151297dc-1010-45e0-b246-53f712d87875","resolution":{"observed_at":"2026-08-09T12:52:42.589239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.768947Z","title":null,"venue":null,"work_id":"1fcf61d8-8095-4451-9621-8cd4e7e3d6f3","year":2000},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.593726Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:b91e870df7341ccf7b4dbda4e63ba60e2cc5fc16ad33bb4462132fe5e557aa74","observation_id":"d62c594a-2212-4135-be0e-414897967939","resolution":{"observed_at":"2026-08-09T12:52:42.772106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:52:42.759724Z","title":null,"venue":null,"work_id":"c3fdec0a-2176-432b-9b6c-715232aa053e","year":2022},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.597013Z"},"links":{"citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:28d501a17b5ba19e0bd9bf363d12d0673938a2ab201570257edf8f15cebdd7b1","observation_id":"7de5df04-cbde-404f-a066-4ea8304f250a","resolution":{"observed_at":"2026-08-09T12:52:42.762931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T12:52:42.572870Z","title":"arXiv preprint arXiv:1707.06347 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.572870Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:f11d3bec296319b78878340a9d62b6ccaf8c9e4e83844a7a0b5eb056a3a3fc40","observation_id":"fa4e6549-6870-4b07-989e-a740689b3068","resolution":{"observed_at":"2026-08-09T12:52:42.572870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.09108","last_updated":"2020-09-30T04:03:27Z","snapshot_observed_at":"2026-08-17T11:06:48.436240Z","submitted_at":"2020-09-30T04:03:27Z","title":"Bridging the gap between Markowitz planning and deep reinforcement learning","version":1},"cited_work":{"arxiv_id":"2010.09108","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.09108","snapshot_observed_at":"2026-08-09T12:52:42.749119Z","title":"Bridging the gap between Markowitz planning and deep reinforcement learning","venue":"cs.LG","work_id":"e553e25d-0c12-439f-9031-0c3f8653751b","year":2020},"citing_paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T12:52:42.470251Z"},"links":{"cited_paper":"/paper/2010.09108","citing_paper":"/paper/2502.02619"},"observation_digest":"sha256:c789725fc5f10e08634c6195b199413ea182bc54d0987579ca36e82bd7a25dc8","observation_id":"188e936e-357e-4355-bf38-1aba716dede6","resolution":{"observed_at":"2026-08-09T12:52:42.753520Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02619","last_updated":"2025-02-04T11:45:59Z","latest_version":1,"primary_category":"q-fin.PM","snapshot_observed_at":"2026-08-21T14:50:20.348541Z","submitted_at":"2025-02-04T11:45:59Z","title":"Regret-Optimized Portfolio Enhancement through Deep Reinforcement Learning and Future Looking Rewards"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":40,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2502.02619."}