{"as_of":"2026-08-21T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:618c1f392d27a9361b9dfde3014c434599c9c200643f194d2b558fc8c2ee4a1d","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:28:30.133653Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03933/citation-record","integrity":"/paper/2608.03933/integrity","json":"/paper/2608.03933/citation-record.json","paper":"/paper/2608.03933"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.16667","last_updated":"2024-03-25T12:04:03Z","snapshot_observed_at":"2026-08-16T14:06:43.498288Z","submitted_at":"2024-03-25T12:04:03Z","title":"Deep Reinforcement Learning and Mean-Variance Strategies for Responsible Portfolio Optimization","version":1},"cited_work":{"arxiv_id":"2403.16667","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.16667","snapshot_observed_at":"2026-08-05T05:28:32.893015Z","title":"Deep Reinforcement Learning and Mean-Variance Strategies for Responsible Portfolio Optimization","venue":"cs.AI","work_id":"6eb9f1fa-b118-4f17-a459-d6105ef2e9f0","year":2024},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:26.945078Z"},"links":{"cited_paper":"/paper/2403.16667","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:8a5d401b6c5020789c1faccd4e9e17e90084dd524f6de000cd151c57b2b3c130","observation_id":"e30aae58-dcf6-4a5f-84b5-89737d1cea5b","resolution":{"observed_at":"2026-08-05T05:28:33.033333Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:33.934768Z","title":"1957.Dynamic Programming","venue":null,"work_id":"989e1fbf-9df6-4b35-9e5c-6929cb1b1a6a","year":1957},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.082210Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:9a695560badba0db2dad5b26e2d61e3210984b29daff44f30c00d55c028dc9d5","observation_id":"78506cbb-40fe-44cc-bd8b-e9c7c81c9906","resolution":{"observed_at":"2026-08-05T05:28:34.074772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:33.764886Z","title":null,"venue":null,"work_id":"72dc7db6-d933-413f-9eae-a13e81afb388","year":2022},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.162128Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:3c80be717ee26df21bd759214ad04f7ed00cd7301827b37804537f9afff199fd","observation_id":"b39ca46d-224e-4cb4-bdc2-db845c0089a2","resolution":{"observed_at":"2026-08-05T05:28:33.840049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/2171853","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Carroll and Miles S","venue":"Econometrica","work_id":"de767922-8099-43b9-a4e6-9612170ed073","year":1996},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.238955Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:315cd4fb8371db69e10ed5609c6201907a603b41f6cb461172c637d875dbace2","observation_id":"5d1595a0-c618-47a6-a752-f30147354af7","resolution":{"observed_at":"2026-08-05T05:28:31.372265Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/rfs/hhi017","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Cocco, Francisco J","venue":"Review of Financial Studies","work_id":"9a2cbc11-21f9-4c38-b920-6f097c03ec7c","year":2005},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.346383Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:d987eddb7dbc1fa8cfdd6989545b2181ed29fb4384f5d86d68ba5cbb3b899310","observation_id":"12da4b16-efd5-4b73-8e20-f9b528e2265a","resolution":{"observed_at":"2026-08-05T05:28:31.065479Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:27.448464Z","title":"Goodman, and Jonathan A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.448464Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:85ab076a4836d8a9d0fe04ace719796332bc27e72447db246b7472c770b14277","observation_id":"33a6bbd0-664d-4754-8105-cd59c98a19ac","resolution":{"observed_at":"2026-08-05T05:28:27.448464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:27.563407Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.563407Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:e806101ea83c370931595e1462677fa129a2468b22807840a471883e6ad379ad","observation_id":"69e01304-0528-456f-be1f-264426d3d2bb","resolution":{"observed_at":"2026-08-05T05:28:27.563407Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:27.667435Z","title":"2016.Deep Learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.667435Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:2cec71ffa631cbf8faf46b119f70236540afdd3b7e7989c94894b2fe4512bc8b","observation_id":"14096051-be24-489a-a3f7-7ce755dcb1b3","resolution":{"observed_at":"2026-08-05T05:28:27.667435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.07422","last_updated":"2016-11-02T02:47:26Z","snapshot_observed_at":"2026-08-20T09:27:22.780612Z","submitted_at":"2016-11-02T02:47:26Z","title":"Deep Learning Approximation for Stochastic Control Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.07422","snapshot_observed_at":"2026-08-05T05:28:27.758490Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.758490Z"},"links":{"cited_paper":"/paper/1611.07422","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:e6aa4c97e3c103a6daad3973e16104585f5183cd312e429f104cf0a59d908063","observation_id":"c5f41f95-c8b5-4260-8446-1d20a0a1d841","resolution":{"observed_at":"2026-08-05T05:28:27.758490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:27.895092Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.895092Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:d19eed0a8a586449772ecb5bcaa4f0ab52209c842c39b8009543c07913fa8781","observation_id":"3b8da8b9-ae0d-44ec-9f9a-48486a4ae3ed","resolution":{"observed_at":"2026-08-05T05:28:27.895092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:33.582308Z","title":null,"venue":null,"work_id":"9b5a43d7-d5aa-435a-8e26-09ec5ae403f7","year":2021},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:27.980573Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:7a964f1c39e0a6762ad7832e71ca2bbd86a7250a41fca3340301e73f3e00ad19","observation_id":"55fed3da-31f0-4d0e-ad88-c88fdc38e268","resolution":{"observed_at":"2026-08-05T05:28:33.659016Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.10059","last_updated":"2017-07-16T10:29:38Z","snapshot_observed_at":"2026-08-15T21:44:03.561563Z","submitted_at":"2017-06-30T08:31:28Z","title":"A Deep Reinforcement Learning Framework for the Financial Portfolio Management Problem","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.10059","snapshot_observed_at":"2026-08-05T05:28:28.114830Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.114830Z"},"links":{"cited_paper":"/paper/1706.10059","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:bb49f8b0dfc088b60b6e09447cf4fcd5aeb075a470d1b672b826e3fb9980a3a9","observation_id":"75e156f9-a4fb-425f-9b15-20871083ef87","resolution":{"observed_at":"2026-08-05T05:28:28.114830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:28.201141Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.201141Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:973c1d4f9e11627c69f62ea691eb461e73a63af0b1aa940a1126a312bfece99b","observation_id":"ff087b80-086b-4456-b210-68023587e5d4","resolution":{"observed_at":"2026-08-05T05:28:28.201141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01503","last_updated":"2019-06-21T02:29:25Z","snapshot_observed_at":"2026-08-19T19:24:53.726392Z","submitted_at":"2019-06-21T02:29:25Z","title":"Optimistic Bull or Pessimistic Bear: Adaptive Deep Reinforcement Learning for Stock Portfolio Allocation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01503","snapshot_observed_at":"2026-08-05T05:28:28.301772Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.301772Z"},"links":{"cited_paper":"/paper/1907.01503","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:6884a54646dc67593391cfd75988629e172bc2cb40acbc62e3adc41e608ac79b","observation_id":"65f39e83-77de-43b5-80a8-e531c627bf1a","resolution":{"observed_at":"2026-08-05T05:28:28.301772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T05:28:28.409082Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.409082Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:330842f351a9315bbe2ba9dcd2d2f2ef8b07ae8986a6e3902d134b78f2df7f54","observation_id":"aea4af67-f011-4877-a25e-60836eaae1a3","resolution":{"observed_at":"2026-08-05T05:28:28.409082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jmoneco.2021.07.004","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:46:29.746714Z","title":null,"venue":"Journal of Monetary Economics","work_id":"5ce1d0a8-246e-42ce-8144-c5a175cdee56","year":2021},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.547867Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:0809767f630907b8d475dbe7e338647473b866d18f015779ac9bccf77e0d3371","observation_id":"2f0ee181-b328-4b30-ab27-ea6da17241d0","resolution":{"observed_at":"2026-08-05T05:28:30.737679Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:32.496135Z","title":null,"venue":null,"work_id":"a93a6b34-b644-45c5-a79a-bc24b2a97fbb","year":1952},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.625830Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:df135fe70e3dcb8a3f680efc23e796fb3705c0eb9fe98a880210223fde4e34ac","observation_id":"e54f719c-f058-46aa-ac68-7e1f353aa32b","resolution":{"observed_at":"2026-08-05T05:28:32.715072Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:28.731378Z","title":null,"venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.731378Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:67969c8c717d37eb44f4ca761bc8ad0db7e3a7328955e0542f7f4d0503f08d3e","observation_id":"4da032e5-401c-4a10-b82c-087e7e09ee86","resolution":{"observed_at":"2026-08-05T05:28:28.731378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-05T05:28:28.820951Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.820951Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:cad0754bc319c528f5e7205b36522f9de82b5e50e0a865834dac954f3a000b86","observation_id":"d4943357-6cbd-4306-b9bd-e43a02b1ef46","resolution":{"observed_at":"2026-08-05T05:28:28.820951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:28.902877Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:28.902877Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:b9cf8ce5718ee73fc63735172f205ce2d59a7d4a11959d418d771f8a42a7b7fe","observation_id":"59d15008-6443-4f19-a4bf-7a5eb674ca4d","resolution":{"observed_at":"2026-08-05T05:28:28.902877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08668","last_updated":"2024-12-06T08:49:54Z","snapshot_observed_at":"2026-08-16T18:48:07.715947Z","submitted_at":"2024-11-13T15:02:54Z","title":"A Machine Learning Algorithm for Finite-Horizon Stochastic Control Problems in Economics","version":2},"cited_work":{"arxiv_id":"2411.08668","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.08668","snapshot_observed_at":"2026-08-05T05:28:31.850863Z","title":"A Machine Learning Algorithm for Finite-Horizon Stochastic Control Problems in Economics","venue":"econ.GN","work_id":"dc51a992-83d8-40c1-a317-5d9b49e4186e","year":2024},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:29.016853Z"},"links":{"cited_paper":"/paper/2411.08668","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:63dbe9d4905297b7843c671d86ef966efd86327d0dd6a0290eab4bbcce337605","observation_id":"43b90f71-5c30-4868-b4e2-5b6f0ccdb08d","resolution":{"observed_at":"2026-08-05T05:28:32.071279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:33.445705Z","title":"2023.Foundations of Reinforcement Learning with Applications in Finance","venue":null,"work_id":"bcb9365b-27e6-45a1-86af-2b15d3622d86","year":2023},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:29.110658Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:13b301214b5a469c036d869afe1f533af0fd02ffebfab8247c1a8c983869eaf5","observation_id":"96c7ef28-7a70-4b93-8bd9-22ac91ede638","resolution":{"observed_at":"2026-08-05T05:28:33.522792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.10099","last_updated":"2022-02-18T18:54:11Z","snapshot_observed_at":"2026-08-16T18:23:14.127063Z","submitted_at":"2021-05-21T02:39:12Z","title":"Learning from zero: how to make consumption-saving decisions in a stochastic environment with an AI algorithm","version":2},"cited_work":{"arxiv_id":"2105.10099","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.10099","snapshot_observed_at":"2026-08-05T05:28:31.533549Z","title":"Learning from zero: how to make consumption-saving decisions in a stochastic environment with an AI algorithm","venue":"econ.TH","work_id":"49ff26b7-cc72-4e42-81b4-8d089a38d544","year":2021},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:29.245022Z"},"links":{"cited_paper":"/paper/2105.10099","citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:07987e67bf6ca5a4195752e8e086779e5ae13357884d9c36bde56b7c067cbe65","observation_id":"7ee1ccd3-8730-49f6-b229-96f9beef05de","resolution":{"observed_at":"2026-08-05T05:28:31.712352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:29.403841Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:29.403841Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:de9a002e63ccebf61b05497b5e8af17c263e08456bb4462b33498a82e678d57d","observation_id":"8418ba68-1aa9-4110-9ae5-cc20050457c1","resolution":{"observed_at":"2026-08-05T05:28:29.403841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:33.304844Z","title":null,"venue":null,"work_id":"b521971c-8c54-4b8f-b788-0b935b5c8904","year":2014},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:29.618705Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:ba93a19f22cf0a46e6331d29e43c74ccff6f3e13623a5e5a6968d797eb26a81b","observation_id":"911ed933-4f4d-466a-86a4-ba44bab84cfc","resolution":{"observed_at":"2026-08-05T05:28:33.364260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:33.143381Z","title":"Sutton and Andrew G","venue":null,"work_id":"9c251eae-d0df-4c09-b17b-a47d18b13754","year":2018},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:29.773462Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:4a3bdc24100652dcaa90cc6cf1013dc27c0426ad50e2a7ca8ccdc9ec68938f10","observation_id":"f70cd350-547d-45ad-9976-aac9e8efadb0","resolution":{"observed_at":"2026-08-05T05:28:33.227643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1137/19m1274924","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"SIAM Journal on Financial Mathematics","work_id":"6d98c9a2-5698-4442-aac8-ebafb01de97b","year":2020},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:29.981245Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:e1de466d417102f5b924afeab19775d032ce620aa1fb3c5ddf0ac47e83208ce9","observation_id":"b60168a6-42d6-4121-ab8a-9b8c4066731a","resolution":{"observed_at":"2026-08-05T05:28:30.380758Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:28:30.133653Z","title":"Williams","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T05:28:30.133653Z"},"links":{"citing_paper":"/paper/2608.03933"},"observation_digest":"sha256:876517807e61f44dc2e4e149fccf82a70b6a611c7c4685359854919743b2788c","observation_id":"11180c39-69dd-4634-93fa-4db260ce1870","resolution":{"observed_at":"2026-08-05T05:28:30.133653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03933","last_updated":"2026-08-04T17:05:50Z","latest_version":1,"primary_category":"math.OC","snapshot_observed_at":"2026-08-14T00:18:18.150447Z","submitted_at":"2026-08-04T17:05:50Z","title":"Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":8,"verified_fuzzy":3},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2608.03933."}