{"as_of":"2026-08-16T16:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b626ec986d10e3de68385b774ea92fd1954c30ebfdffd24c6964704542910d4f","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:22:57.542517Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.05906/citation-record","integrity":"/paper/2412.05906/integrity","json":"/paper/2412.05906/citation-record.json","paper":"/paper/2412.05906"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.15385","last_updated":"2023-12-24T02:08:49Z","snapshot_observed_at":"2026-08-16T14:31:55.871906Z","submitted_at":"2023-12-24T02:08:49Z","title":"Discrete-Time Mean-Variance Strategy Based on Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2312.15385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.15385","snapshot_observed_at":"2026-08-11T20:22:57.617247Z","title":"Discrete-Time Mean-Variance Strategy Based on Reinforcement Learning","venue":"q-fin.MF","work_id":"203309e7-82eb-4671-88ea-fa0b1f66d458","year":2023},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.489461Z"},"links":{"cited_paper":"/paper/2312.15385","citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:2e511be9269c0ffe86fee035701fc9276e333eef07e264d08504396c8b0e0156","observation_id":"b3af0da2-9c2f-4ca9-a0a4-5ff03c09587f","resolution":{"observed_at":"2026-08-11T20:22:57.622742Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02307","last_updated":"2023-01-27T14:54:57Z","snapshot_observed_at":"2026-08-13T18:33:53.382391Z","submitted_at":"2021-08-04T22:43:51Z","title":"Regret Analysis of Learning-Based MPC with Partially-Unknown Cost Function","version":2},"cited_work":{"arxiv_id":"2108.02307","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.02307","snapshot_observed_at":"2026-08-11T20:22:57.592745Z","title":"Regret Analysis of Learning-Based MPC with Partially-Unknown Cost Function","venue":"math.OC","work_id":"c49678ff-dbce-4a7f-80cc-830068783c9c","year":2021},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.494211Z"},"links":{"cited_paper":"/paper/2108.02307","citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:a11abbae3d6d557d6765994c60c9f116ba6e3e64a5c29f1079704c97a2643a94","observation_id":"6ff2ad1d-8888-4b62-b2ee-6da25fbabe4c","resolution":{"observed_at":"2026-08-11T20:22:57.598877Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.731096Z","title":null,"venue":null,"work_id":"5a5f5e5a-0c21-4e31-97cb-12776e1fef7b","year":2000},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.498325Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:72d2ed9897917b385bafd525af22945f074cb52ac163d08e76f0a3cf22e85d78","observation_id":"f52cd8c5-287e-4147-a396-3d79e9662192","resolution":{"observed_at":"2026-08-11T20:22:57.735501Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.714986Z","title":null,"venue":null,"work_id":"9a8e7a16-bd93-4058-a35f-2a0de3f6d258","year":2017},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.506451Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:3effae2e3b5182f55aa220279d188566e193d11fa5e26909dd559a5019cf2b43","observation_id":"210d0da2-3b52-4c68-bb07-d704b8ac8c20","resolution":{"observed_at":"2026-08-11T20:22:57.721912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.699624Z","title":null,"venue":null,"work_id":"5b45a549-98ad-43a4-aa2a-0dc813b35c07","year":null},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.511033Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:d7a04c486a6b926bad727648d68fe1be84f490528593c490e378e9ea51acae21","observation_id":"3d03a756-3cca-4f94-bdb2-e42d09a7d430","resolution":{"observed_at":"2026-08-11T20:22:57.703974Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.686550Z","title":null,"venue":null,"work_id":"9b93b921-548f-4286-9f1d-5f4816e719aa","year":1954},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.517343Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:1e50ee53c1fc16b123a7d970e7ef38ee23234347aaf22dd9647d5b8264318648","observation_id":"21a4cbcf-4398-4529-bcc7-52d766feb990","resolution":{"observed_at":"2026-08-11T20:22:57.690824Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.673041Z","title":"Barto, A.G","venue":null,"work_id":"48a028bb-355a-4636-bd22-f38cea5c871c","year":1998},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.521751Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:840d765d92812d6aedc353bc2cfc2a13d05173383d17ac9cb26cd0fbf411354f","observation_id":"4145d4b9-f56b-4452-a4cf-22baf6598199","resolution":{"observed_at":"2026-08-11T20:22:57.677744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.657190Z","title":null,"venue":null,"work_id":"665c3234-ffeb-4191-bc6d-f858b8304e01","year":2020},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.527570Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:e5d1c55abd4b698aadb7ae608b0617a3e0e5f45aefb55267fc51efdc54d2f118","observation_id":"18d9bc7d-2ba9-4e45-8a20-6233c0649eb2","resolution":{"observed_at":"2026-08-11T20:22:57.661065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08796","last_updated":"2020-04-24T14:45:14Z","snapshot_observed_at":"2026-08-14T11:42:53.820627Z","submitted_at":"2019-08-22T08:32:49Z","title":"Reinforcement Learning in Healthcare: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08796","snapshot_observed_at":"2026-08-11T20:22:57.532209Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.532209Z"},"links":{"cited_paper":"/paper/1908.08796","citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:5af7b58ba7bf3a1dce732a51e616f0e0de3856fec45b7c2ae07067c44627041a","observation_id":"fcdbd73c-4856-4987-92d9-257d624ece7f","resolution":{"observed_at":"2026-08-11T20:22:57.532209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.643121Z","title":"xt+1 yt+1 !′ P xt+1 yt+1 ! Ft # = xt yt !′","venue":null,"work_id":"08dd2e1f-4a99-477b-a8f4-9659fff89234","year":2000},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.537125Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:9422e05544026bd5438bcb754cd43256423ca0982203b3e39bb5b5b6416ae78f","observation_id":"21c44b01-3919-471d-99c8-9df96d15d9b8","resolution":{"observed_at":"2026-08-11T20:22:57.647057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:22:57.631164Z","title":"A 0 0 ¯A !′ ¯M t+j+1 t A 0 0 ¯A ! + 0 0 0 ¯C !′ ¯M t+j+1 t 0 0 0 ¯C !# xt yt ! + 2 Z R xt yt !′","venue":null,"work_id":"1f427ccd-0619-4911-8645-2cbfc6583ce7","year":null},"citing_paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:22:57.542517Z"},"links":{"citing_paper":"/paper/2412.05906"},"observation_digest":"sha256:aea3232fb980cc8b6551a951de8d4484c6d6815e85d66e9e7cb9208c751a76ec","observation_id":"8eaba682-4e74-42f1-b9ea-21c35e4bcea5","resolution":{"observed_at":"2026-08-11T20:22:57.635041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.05906","last_updated":"2025-02-04T10:22:04Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-16T09:13:16.140744Z","submitted_at":"2024-12-08T11:55:13Z","title":"Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 0 inbound Pith citation observations for arXiv:2412.05906."}