{"as_of":"2026-08-07T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:657e6d24aa630a0c4587333a25b2ccabb491173daa08ba1817be6591a3147c6d","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:59:29.884758Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23244/citation-record","integrity":"/paper/2505.23244/integrity","json":"/paper/2505.23244/citation-record.json","paper":"/paper/2505.23244"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:28.346715Z","title":"Williams, Simple Statistical Gradient-Following Algorithms for Connectionist Reinforcement Learn- ing","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:28.346715Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:670df77dad593e000e4bc72b278bd0f872574a78f28efcec0f46c80883125f1f","observation_id":"d6ed50c2-e24a-4539-9dc0-1ebead028663","resolution":{"observed_at":"2026-08-07T12:59:28.346715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:28.490621Z","title":"Amari, Natural Gradient Works Efficiently in Learning","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:28.490621Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:d5986299d26c5378057938a3d06ed4b81ce8ccd8a9025f3365cfe5ad2498292e","observation_id":"d7b99730-2a05-464a-98a2-b5e48986f3ca","resolution":{"observed_at":"2026-08-07T12:59:28.490621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:28.631769Z","title":"Sutton, D","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:28.631769Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:0154501087f7329b5d2f3a0785f934daf2f7baef0b6c067e74e7d0baab37b88a","observation_id":"86a1a3bf-59e6-40c6-9bdd-9c67d6f0e67b","resolution":{"observed_at":"2026-08-07T12:59:28.631769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:28.814513Z","title":"Kakade, A Natural Policy Gradient","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:28.814513Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:38722df982f28dc161f62f3a1d70fe8b79fa91b9b807c6d3b915c1074960e413","observation_id":"caf38370-71ce-4142-9d98-2f0cbe907d0d","resolution":{"observed_at":"2026-08-07T12:59:28.814513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:31.139244Z","title":"Todorov, Lineary-solvable Markov decision problems","venue":null,"work_id":"8c8bdd0d-4b8d-43f4-b5c8-68f77320276c","year":2006},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:28.895088Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:4ab26da2e75c394697093f6123a57c04b97c105b83820d75833d9715b286ee99","observation_id":"17efe37e-0539-433c-b43e-37868a62a573","resolution":{"observed_at":"2026-08-07T12:59:31.254023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:28.986703Z","title":"Peters and S","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:28.986703Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:f726cdc19e12a96ee4d9c8ffedb828402b918773c2e5fa1a64671c67595d08be","observation_id":"471feaae-8410-4ff8-bbd0-12e4ecab025a","resolution":{"observed_at":"2026-08-07T12:59:28.986703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:29.096487Z","title":"Silver, G","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.096487Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:719d4d726bdad2d8cad29407f9237bd9661075bde57eb43fe79f7ca2668a1711","observation_id":"52f34415-5466-4eb2-8a9a-156aedd6bc2c","resolution":{"observed_at":"2026-08-07T12:59:29.096487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:30.949206Z","title":"Todorov, Convex and analytically-invertible dynamics with contacts and constraints: Theory and implementation in MuJoCo","venue":null,"work_id":"cfa46c44-4aa4-4de8-b92b-d13438f12c54","year":2014},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.183672Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:bc552e9d0d7bb054ec95ade5ea8cf83798cbd87d0e009e440f369b6857a483ce","observation_id":"588d8104-6aac-40ed-a952-be76780cce76","resolution":{"observed_at":"2026-08-07T12:59:31.013844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:29.294517Z","title":"Sutton and A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.294517Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:32eca3b1ad2601b41180ec6d4e3b6ede049db37a5656f65fa0bbc538f012408f","observation_id":"1a6fe948-f573-4248-badd-215aead4470d","resolution":{"observed_at":"2026-08-07T12:59:29.294517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:30.707547Z","title":"Ciosek and S","venue":null,"work_id":"c9fce480-14ad-434d-b19a-086dc0604fb1","year":2020},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.412389Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:f5e9ca927e80bad5b9e3c94567c8c5590af1cb05c6d9f5f571c89385c2b194d2","observation_id":"73d7de37-da59-4057-bbfb-296ba197f135","resolution":{"observed_at":"2026-08-07T12:59:30.805288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:30.520513Z","title":"Szepesv´ ari, Policy gradients","venue":null,"work_id":"05ec8773-5e19-409f-be2a-d8cc294f449d","year":2022},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.518730Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:f9d8933abfc5aae515555762316772e57232998b6f6917cac125342c4e4db434","observation_id":"f436505e-3d12-431c-b2fb-6c4f353a63f1","resolution":{"observed_at":"2026-08-07T12:59:30.593400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:29.624070Z","title":"Bhandari and D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.624070Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:e1f24f67c67b014399d56e4bd0e3cd74c9cec2712ce89f8566b62f08debf7570","observation_id":"60a59dcf-e2db-486a-96da-73c7d86a585e","resolution":{"observed_at":"2026-08-07T12:59:29.624070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:30.232533Z","title":null,"venue":null,"work_id":"2105aa8e-fc0c-43c3-9503-08456d7ac9e6","year":2025},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.770370Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:4ec911bfd7ec1bf5a7b4d85c08a52148509b9a4eb1ba10d7bde4c23fc4b13026","observation_id":"13b0b48c-9e18-45db-bfeb-aa67359a237e","resolution":{"observed_at":"2026-08-07T12:59:30.363099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:30.026489Z","title":"Todorov, Dynamical System Optimization","venue":null,"work_id":"6282526b-9125-442d-95e5-d499de6b3b19","year":2025},"citing_paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:29.884758Z"},"links":{"citing_paper":"/paper/2505.23244"},"observation_digest":"sha256:0be2b9b8ba90324b29568ee10a3738934b23da71fb67a6afcb654852c39a300f","observation_id":"3f0185fd-7f2f-43ec-b125-f5110267dc70","resolution":{"observed_at":"2026-08-07T12:59:30.094762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23244","last_updated":"2025-06-10T01:48:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:47:20.513486Z","submitted_at":"2025-05-29T08:51:34Z","title":"Equivalence of stochastic and deterministic policy gradients"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2505.23244."}