{"as_of":"2026-08-08T11:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d6761c98f50bf8932363b49424dd695c52f28a0b7032396ca4d8fe039f0cb0b","coverage":[{"denominator":10,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:22:39.912008Z","state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.00174/citation-record","integrity":"/paper/2508.00174/integrity","json":"/paper/2508.00174/citation-record.json","paper":"/paper/2508.00174"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:22:39.831214Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.831214Z"},"links":{"citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:2f0903e5f6615922ad46d58e1eb335768bf056de39550c8926150268e94a6696","observation_id":"5ce3feee-9866-4728-b44a-08c997b7f8df","resolution":{"observed_at":"2026-08-06T10:22:39.831214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:22:40.236510Z","title":"The Epoch-Greedy algorithm for contextual multi-armed ban- dits","venue":null,"work_id":"be11cbd0-dbb8-4681-bc0f-df271af5eaea","year":2007},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.852952Z"},"links":{"citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:c4a1d4d42a17d5dd86d15281e11c3419646456520f22304bba171a9d5a745c6c","observation_id":"ca7d71d4-59ed-4238-a674-fee32b7be47e","resolution":{"observed_at":"2026-08-06T10:22:40.247156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T10:22:39.860700Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.860700Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:c5b18fd3ccb6f83f0a99056fbd91a81e7eb1b20ca4c32173875db70cdbf22740","observation_id":"e016c715-2f26-4389-ac9a-7f4e96c90cb5","resolution":{"observed_at":"2026-08-06T10:22:39.860700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:22:40.190138Z","title":"Rusu, Joel Veness, Marc G","venue":null,"work_id":"82033857-a01d-40a6-8a1f-f698defebf75","year":2015},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.869940Z"},"links":{"citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:7b329480aaca9aff7542b07f4aa5f8708c1a850db04ab381b2df2e84c344f87a","observation_id":"a00fd9c3-4d79-45c2-9f97-483a6b4b28ef","resolution":{"observed_at":"2026-08-06T10:22:40.207872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05952","last_updated":"2016-02-25T17:55:31Z","snapshot_observed_at":"2026-07-06T04:37:00.543211Z","submitted_at":"2015-11-18T20:54:44Z","title":"Prioritized Experience Replay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05952","snapshot_observed_at":"2026-08-06T10:22:39.880110Z","title":"Prioritized Experience Replay, February 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.880110Z"},"links":{"cited_paper":"/paper/1511.05952","citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:42a742d8af70f7bca52e0b322f236a4a99ef621294f553edc785548ed79c3607","observation_id":"7d71f200-2ace-4a3a-8d17-8c6b71374bca","resolution":{"observed_at":"2026-08-06T10:22:39.880110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:22:40.152131Z","title":"Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes, September","venue":null,"work_id":"436aa69c-c4e1-4261-8501-0db7b2a1312e","year":null},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.888843Z"},"links":{"citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:ca672ac2f4b63e4992ebf84641e22b2107a3a8c09f1e2406e062cef29968d2fc","observation_id":"481af0a1-4102-481d-ace0-423ff444e8cb","resolution":{"observed_at":"2026-08-06T10:22:40.160553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:22:40.119486Z","title":"Attention is All you Need","venue":null,"work_id":"5144ef46-df5f-4dca-9d13-a2b1d1c3d4f2","year":2017},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.905287Z"},"links":{"citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:eaa14d0aadf2f56b1e1cd37d94d1e0abe40c702f52575be9a35fa00630a6ae40","observation_id":"ab7f593d-a19b-4e53-a746-8f6651ea93f5","resolution":{"observed_at":"2026-08-06T10:22:40.130166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:22:40.089069Z","title":"Williams","venue":null,"work_id":"61e0d90a-eecb-4831-b407-9d6b6d4842e2","year":1992},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.912008Z"},"links":{"citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:5fdb950c48c6e5d4496eaaca94103804226ce58b3a130e253ba38de15a4116e8","observation_id":"028d9631-f1df-4e09-81cf-3f4679d1fa88","resolution":{"observed_at":"2026-08-06T10:22:40.102563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T10:22:39.840704Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.840704Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:b8fa09463e569c3fedcd231a48a077cff9996d59b68439c283a40e62428930aa","observation_id":"ed4e51f2-06d5-4898-8a74-0b97c30afdab","resolution":{"observed_at":"2026-08-06T10:22:39.840704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03539","last_updated":"2024-09-16T15:41:05Z","snapshot_observed_at":"2026-07-06T18:57:43.764663Z","submitted_at":"2024-08-07T04:35:38Z","title":"Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03539","snapshot_observed_at":"2026-08-06T10:22:39.899194Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T10:22:39.899194Z"},"links":{"cited_paper":"/paper/2408.03539","citing_paper":"/paper/2508.00174"},"observation_digest":"sha256:1b8b929d6feec511223cb9019e7101fe5a6476b4b13f6a23e3bf117421b96184","observation_id":"71c9dd8f-fd74-41b4-beb6-56d24296c8b6","resolution":{"observed_at":"2026-08-06T10:22:39.899194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.00174","last_updated":"2025-07-31T21:39:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T10:22:38.801716Z","submitted_at":"2025-07-31T21:39:24Z","title":"RL as Regressor: A Reinforcement Learning Approach for Function Approximation"},"reference_resolution":{"displayed":10,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":10},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 10 of 10 outbound references and 0 inbound Pith citation observations for arXiv:2508.00174."}