{"as_of":"2026-08-12T21:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f2538c14c9921eb5b5dba4508adcf966a04f4245db85470f18078e1363a069e4","coverage":[{"denominator":3,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:46:45.723165Z","state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T00:59:20.790604Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T08:31:26.842069Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","version":3},"cited_work":{"arxiv_id":"2602.01460","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.01460","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","venue":null,"work_id":"3b1049b2-5a89-459f-9acb-b2dfb0653ca8","year":2026},"citing_paper":{"arxiv_id":"2604.21456","last_updated":"2026-05-09T11:13:02Z","snapshot_observed_at":"2026-08-12T17:29:23.102566Z","submitted_at":"2026-04-23T09:13:59Z","title":"Tempered Sequential Monte Carlo for Trajectory and Policy Optimization with Differentiable Dynamics","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T22:15:38.911842Z"},"links":{"cited_paper":"/paper/2602.01460","citing_paper":"/paper/2604.21456"},"observation_digest":"sha256:de26c0c6cc9e16f288c9eb55f4159ca3ddf8cfffa2849c443db7ffa0845214cd","observation_id":"aa37624c-5c3f-40fa-be20-6c905fd5360c","resolution":{"observed_at":"2026-06-02T02:03:17.941824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","version":3},"cited_work":{"arxiv_id":"2602.01460","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.01460","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","venue":null,"work_id":"3b1049b2-5a89-459f-9acb-b2dfb0653ca8","year":2026},"citing_paper":{"arxiv_id":"2604.21456","last_updated":"2026-05-09T11:13:02Z","snapshot_observed_at":"2026-08-12T17:29:23.102566Z","submitted_at":"2026-04-23T09:13:59Z","title":"Tempered Sequential Monte Carlo for Trajectory and Policy Optimization with Differentiable Dynamics","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T00:59:20.790604Z"},"links":{"cited_paper":"/paper/2602.01460","citing_paper":"/paper/2604.21456"},"observation_digest":"sha256:3ae840479a8c7c2042323e9ea281e80cd18e49bb1e62e5648db912e03e0d8602","observation_id":"5a80f587-4a4f-4678-ae27-e87e20a5f66f","resolution":{"observed_at":"2026-06-02T02:03:17.941824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","version":3},"cited_work":{"arxiv_id":"2602.01460","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.01460","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","venue":null,"work_id":"3b1049b2-5a89-459f-9acb-b2dfb0653ca8","year":2026},"citing_paper":{"arxiv_id":"2605.01865","last_updated":"2026-05-03T13:20:00Z","snapshot_observed_at":"2026-08-11T14:41:34.330447Z","submitted_at":"2026-05-03T13:20:00Z","title":"Quality-Aware Exploration Budget Allocation for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T19:35:39.458735Z"},"links":{"cited_paper":"/paper/2602.01460","citing_paper":"/paper/2605.01865"},"observation_digest":"sha256:24cf85a892e29467d483c08fcfaefee0e4adbd2cd843285dfc4b24d51bc0de08","observation_id":"e671bd93-758a-42ce-a38b-ce5b8a065f45","resolution":{"observed_at":"2026-06-02T02:03:17.941824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","version":3},"cited_work":{"arxiv_id":"2602.01460","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.01460","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","venue":null,"work_id":"3b1049b2-5a89-459f-9acb-b2dfb0653ca8","year":2026},"citing_paper":{"arxiv_id":"2605.06732","last_updated":"2026-05-11T21:19:23Z","snapshot_observed_at":"2026-08-11T14:39:16.523303Z","submitted_at":"2026-05-07T12:51:32Z","title":"On Training in Imagination","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-11T01:00:03.971064Z"},"links":{"cited_paper":"/paper/2602.01460","citing_paper":"/paper/2605.06732"},"observation_digest":"sha256:6d162b3882d2b50128bb09b6964938c57027381caa6385f389f6ee9175f49731","observation_id":"b8f2694b-9a50-46bc-a4da-454b9fd86a33","resolution":{"observed_at":"2026-06-02T02:03:17.941824Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.01460/citation-record","integrity":"/paper/2602.01460/integrity","json":"/paper/2602.01460/citation-record.json","paper":"/paper/2602.01460"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:46:45.723165Z","title":"Plugging into (68) gives E[∥ bGℓ∥2 2]≤TE h (2∥Σ−1/2 ¯ε∥4 2+2mT)R(τ) 2 i","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T05:46:45.723165Z"},"links":{"citing_paper":"/paper/2602.01460"},"observation_digest":"sha256:781c3ea01fa0a888d5aa236f6c691bf6f300fafa6521192f4a826d352af6cd08","observation_id":"989023b2-ccb0-466c-9ad7-009b3cd9285d","resolution":{"observed_at":"2026-08-03T05:46:45.723165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.02553","last_updated":"2020-05-25T16:24:26Z","snapshot_observed_at":"2026-08-11T02:16:51.471401Z","submitted_at":"2018-11-06T18:54:21Z","title":"A Closer Look at Deep Policy Gradients","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.02553","snapshot_observed_at":"2026-08-03T05:46:45.544917Z","title":"policy collapse","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","version":3},"reference_index":666,"source":"pdf_text","source_observed_at":"2026-08-03T05:46:45.544917Z"},"links":{"cited_paper":"/paper/1811.02553","citing_paper":"/paper/2602.01460"},"observation_digest":"sha256:22da309f183d0f6e4724f7458f42cba10b2873462af1e2fa1db6bf7b54f0f23e","observation_id":"d6944c20-4bca-479a-9fd6-f58f1b09d5e7","resolution":{"observed_at":"2026-08-03T05:46:45.544917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:46:45.622396Z","title":"Our setting involves a non-homogeneous polynomial, hence we state the following lemma","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator","version":3},"reference_index":1978,"source":"pdf_text","source_observed_at":"2026-08-03T05:46:45.622396Z"},"links":{"citing_paper":"/paper/2602.01460"},"observation_digest":"sha256:e46833d952ee3bef09907d2c238792d864ae5f45fa6392dfdcc0858202dc0f9f","observation_id":"349366c5-ab36-45a7-8f4d-0532690b3ae4","resolution":{"observed_at":"2026-08-03T05:46:45.622396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.01460","last_updated":"2026-05-29T18:44:29Z","latest_version":3,"primary_category":"math.OC","snapshot_observed_at":"2026-08-03T05:46:39.894404Z","submitted_at":"2026-02-01T22:05:48Z","title":"Non-Uniform Noise-to-Signal Ratio in the REINFORCE Policy-Gradient Estimator"},"reference_resolution":{"displayed":3,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":3},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 3 of 3 outbound references and 4 inbound Pith citation observations for arXiv:2602.01460."}