{"as_of":"2026-08-10T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ebdbec3d00f29e665ce85e38a928ae2612285d0906faedfd9d74d9cb70f82d73","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T21:30:15.890050Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T04:43:58.646419Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T04:45:54.928527Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"cited_work":{"arxiv_id":"2501.19080","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19080","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Differentially private policy gradient","venue":null,"work_id":"b3328b1c-dbf3-4f44-bd04-5c4824f034e7","year":2025},"citing_paper":{"arxiv_id":"2510.21060","last_updated":"2026-05-13T01:55:58Z","snapshot_observed_at":"2026-08-08T09:53:07.021031Z","submitted_at":"2025-10-24T00:21:38Z","title":"On the Sample Complexity of Differentially Private Policy Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T04:43:58.646419Z"},"links":{"cited_paper":"/paper/2501.19080","citing_paper":"/paper/2510.21060"},"observation_digest":"sha256:6176ee63c6ff1ed119bb2561d1829b024719f7e8a043564b426b7fcc824a6943","observation_id":"add2b129-436b-490f-b027-c5b947577afd","resolution":{"observed_at":"2026-05-18T04:45:54.931081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.19080/citation-record","integrity":"/paper/2501.19080/integrity","json":"/paper/2501.19080/citation-record.json","paper":"/paper/2501.19080"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:15.743550Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.743550Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:1fd671b945d9d1ba467592f3dd88a00ea7347679d3e6e2d74c147b0563d7ad7e","observation_id":"4e579b9e-a72b-46ed-9d9d-dee39411f9d3","resolution":{"observed_at":"2026-08-09T21:30:15.743550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.678067Z","title":"J., McMahan, H","venue":null,"work_id":"f7db6603-e42e-435a-89fb-f1aca635cdec","year":2016},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.748845Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:7c383ec28f0c927df3f1b12a426dc6dd41ca3b2b88cf27c985268ca3519c083f","observation_id":"4bed5896-1892-4950-adca-b5592ace892d","resolution":{"observed_at":"2026-08-09T21:30:16.681801Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:15.752756Z","title":"M., Crump, T., and Far, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.752756Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:c45cd40f7c5da4fc37743a8a9e355508e849ae8ced2cdd105203cc3b8e7a8e73","observation_id":"7360e828-5dac-4d69-bcf8-0be359b1cacf","resolution":{"observed_at":"2026-08-09T21:30:15.752756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-09T23:24:21.399948Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-09T21:30:15.757092Z","title":"OpenAI Gym","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.757092Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:bc0e4f9c188621ddbbdf0cb28d8a0061e0ba0d26eb936e5c7bf8a02a401e4bd5","observation_id":"c55c6199-3017-4a66-9793-241b1fb055d4","resolution":{"observed_at":"2026-08-09T21:30:15.757092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.885832Z","title":"B., Song, D., Erlingsson, \\' U ., Oprea, A., and Raffel, C","venue":null,"work_id":"0917eefe-1fbc-4256-bf08-bd9e9b0c3e62","year":2021},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.761943Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:7310a4f46e2cceac5cd1f782ce159e0ddde0f2e86ff390992bb2a889779b747f","observation_id":"3b603473-cbb7-45ff-bd59-5629d312af3a","resolution":{"observed_at":"2026-08-09T21:30:16.890038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10599","last_updated":"2021-12-20T15:12:23Z","snapshot_observed_at":"2026-07-06T12:20:39.566126Z","submitted_at":"2021-12-20T15:12:23Z","title":"Differentially Private Regret Minimization in Episodic Markov Decision Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10599","snapshot_observed_at":"2026-08-09T21:30:15.766166Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.766166Z"},"links":{"cited_paper":"/paper/2112.10599","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:702eba95e939d9a720dd5c28dc9b36491ee5665b7ddc140c518aba864bf92c73","observation_id":"4796ad30-7028-4293-bd69-5173272fa7fa","resolution":{"observed_at":"2026-08-09T21:30:15.766166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.874586Z","title":"Privacy-constrained policies via mutual information regularized policy gradients","venue":null,"work_id":"b06cfa76-afb7-4bf3-9fe7-bc75f9d66669","year":2024},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.770724Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:53fd2cb61a5d1b7b083f29e91f05be1b12e77bd9834251315411bc943210d1b1","observation_id":"9856e454-0b9f-4e06-a90a-d093618f274e","resolution":{"observed_at":"2026-08-09T21:30:16.878557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14331","last_updated":"2026-07-27T18:39:58Z","snapshot_observed_at":"2026-08-09T03:03:30.149725Z","submitted_at":"2020-12-23T05:45:41Z","title":"Methods to integrate multinormals and compute classification measures","version":14},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14331","snapshot_observed_at":"2026-08-09T21:30:15.775407Z","title":"and Geisler, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.775407Z"},"links":{"cited_paper":"/paper/2012.14331","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:00fd495ef3caaf7bee2287f118fc33411aec4522276d50aafe20b4b0c2464cbf","observation_id":"61320afe-e3f7-4a8c-bc25-4e84a68029ed","resolution":{"observed_at":"2026-08-09T21:30:15.775407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-09T21:30:15.780088Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.780088Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:1b9f819d64de383c10de177b80af80296a4032a3d7e981026f54057c69992033","observation_id":"e378d8d6-1ce5-4d60-bfe1-29842c7f2e1d","resolution":{"observed_at":"2026-08-09T21:30:15.780088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.864249Z","title":"Differential Privacy","venue":null,"work_id":"d46029ef-7368-454b-9763-fcc9c18ff595","year":2006},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.784240Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:b6c6a339a7531a029942e67dde1f6152a7f4a00152959a1414f53befb081abe0","observation_id":"ccc0626b-abbb-415b-8c42-27d374830c30","resolution":{"observed_at":"2026-08-09T21:30:16.867951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06062","last_updated":"2024-11-26T03:19:15Z","snapshot_observed_at":"2026-08-10T09:25:53.294934Z","submitted_at":"2023-11-10T13:55:05Z","title":"Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06062","snapshot_observed_at":"2026-08-09T21:30:15.788544Z","title":"Practical membership inference attacks against fine-tuned large language models via self-prompt calibration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.788544Z"},"links":{"cited_paper":"/paper/2311.06062","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:2a4a40c03e71ba2adc2729f105f4b1169c710a593989c758f5af83cf804af251","observation_id":"e8bf427f-d0c0-4209-b46e-6a5a0e81cf30","resolution":{"observed_at":"2026-08-09T21:30:15.788544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.418485Z","title":"Membership inference attacks against temporally correlated data in deep reinforcement learning","venue":null,"work_id":"08fa70b7-2cb0-4f8f-a468-ffa7d7589a38","year":2023},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.792957Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:a7ca6b0c1ed10b2f804017a7e52c871aa8ff082cbb2a647a70d1c1d3453d8140","observation_id":"54a366c5-8195-4ec2-b3d0-bb8a3daa6366","resolution":{"observed_at":"2026-08-09T21:30:16.422345Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.853698Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"146f15c0-8ce5-4219-a46b-4a0de1ee7f0b","year":2018},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.796553Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:cb5fdbc769b5e60f1e7959397943e1d5f010521dee800682bedae9074d6a82e5","observation_id":"9eb40fc7-c78a-4c9f-adb2-c55053d1b21f","resolution":{"observed_at":"2026-08-09T21:30:16.857332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04553","last_updated":"2023-02-28T07:55:21Z","snapshot_observed_at":"2026-08-10T02:42:09.872465Z","submitted_at":"2021-12-08T19:55:26Z","title":"Recent Advances in Reinforcement Learning in Finance","version":4},"cited_work":{"arxiv_id":"2112.04553","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.04553","snapshot_observed_at":"2026-08-09T21:30:16.182545Z","title":"Recent Advances in Reinforcement Learning in Finance","venue":"q-fin.MF","work_id":"b63f810e-d5cc-48cd-9b7b-cdbd7d7de083","year":2021},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.799938Z"},"links":{"cited_paper":"/paper/2112.04553","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:8a30d277dd361cce679a1b4c1dbb0d9e6efd5c6f4073be6f278a13b19856cd43","observation_id":"98aa3d4b-bbbc-4a58-a10c-8f389b5edfcf","resolution":{"observed_at":"2026-08-09T21:30:16.187990Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:15.803946Z","title":null,"venue":null,"work_id":null,"year":1953},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.803946Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:9579bbe968f46957435f146decca2fd8c2d159bdd130afb81aa9adecb06d3078","observation_id":"8bb07358-54e9-436d-a945-5e87c39b0636","resolution":{"observed_at":"2026-08-09T21:30:15.803946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.842750Z","title":null,"venue":null,"work_id":"e9b0cbc1-d6d9-4712-b0ca-3c6ad8836b90","year":2001},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.807414Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:043310a7da3619e20bc013ffc5e7e00da6dc77fb7629ecc944bdc2d4a2e206c1","observation_id":"9d991cd4-db4f-4751-a8a7-986c7acff841","resolution":{"observed_at":"2026-08-09T21:30:16.846809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:15.810672Z","title":"A survey of reinforcement learning from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.810672Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:83bf2dd1434d98c8f44998df3af03c2c3c201be15d7b191d8fd75d63f5b85f11","observation_id":"a29345e9-708a-425f-8324-80dc44080024","resolution":{"observed_at":"2026-08-09T21:30:15.810672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-09T21:30:15.814030Z","title":"P., Hunt, J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.814030Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:815bf80beec9e79e5360c489d6250dc3d14cbf231129fae2cff3fd17c962194a","observation_id":"f5806525-bfd6-4f82-9523-34040fabf55c","resolution":{"observed_at":"2026-08-09T21:30:15.814030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.832544Z","title":"Deep reinforcement learning for personalized treatment recommendation","venue":null,"work_id":"62676abc-2b29-4152-b660-3eb6459d5147","year":2022},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.817552Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:1efe036e3145cd47abc171bdf75b7e386f80611c22912a32109406baf077a70f","observation_id":"5e2b564a-64c2-47d6-b4ba-aa5ae426eea1","resolution":{"observed_at":"2026-08-09T21:30:16.836423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.822687Z","title":"B., Ramage, D., Talwar, K., and Zhang, L","venue":null,"work_id":"c17ff4d1-eafa-4e43-ae6f-d388a03834a3","year":2018},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.821038Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:2661cc2cab36082e09f2d513eef53900494f2234e6e68fe16180d015bac8e19f","observation_id":"86f356fc-1302-4c13-8deb-52fe89c5b104","resolution":{"observed_at":"2026-08-09T21:30:16.825984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.812900Z","title":"P., Mirza, M., Graves, A., Lillicrap, T","venue":null,"work_id":"dfbe86df-f7cb-45f3-9d3d-8ca30a3ce015","year":2016},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.824363Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:20f9aa75f7859daeba2b01ed1d194e630968f5f138819daa62f63efd5d8f8be4","observation_id":"fc6cffc4-05ba-4d9c-b687-bdf7b9e5087b","resolution":{"observed_at":"2026-08-09T21:30:16.816392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.802124Z","title":null,"venue":null,"work_id":"91aae1c2-c25d-45d5-ae90-e507a9fad785","year":2013},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.827707Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:aa354a07b41510f425ce9d394e799de2f60dc003a9dc19a5d817622c698221d8","observation_id":"9c915feb-6a6c-4499-af10-d5719ec452b6","resolution":{"observed_at":"2026-08-09T21:30:16.806025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.791533Z","title":"How You Act Tells a Lot : Privacy - Leaking Attack on Deep Reinforcement Learning","venue":null,"work_id":"4c469dbf-0e18-44a9-a387-defd10e64000","year":2019},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.831110Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:cfce906bbf73690a08952b6a25bb8b68534ea47cfd2564cee8ce525973916b31","observation_id":"1ec8fa84-a5fe-412e-bef7-2adf4bc6b005","resolution":{"observed_at":"2026-08-09T21:30:16.795169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/9781119432036","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Zurich Open Repository and Archive (University of Zurich)","work_id":"4ad2cdc6-633f-494b-8585-8834fdf2be64","year":2019},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.834687Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:e3f156c50c74f8a7b8cf6bf04e5a8442b896a3570647a9af977904c8a790d559","observation_id":"16aa96e0-eee4-4233-8248-3e3ac9280947","resolution":{"observed_at":"2026-08-09T21:30:15.951861Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00654","last_updated":"2023-07-31T19:10:09Z","snapshot_observed_at":"2026-07-06T14:57:28.489012Z","submitted_at":"2023-03-01T16:56:39Z","title":"How to DP-fy ML: A Practical Guide to Machine Learning with Differential Privacy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00654","snapshot_observed_at":"2026-08-09T21:30:15.838186Z","title":"B., Vassilvitskii, S., Chien, S., and Thakurta, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.838186Z"},"links":{"cited_paper":"/paper/2303.00654","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:a357f2dfa542e327628f40766117ded2ef9496074e4a8d32fd482c596de9d68d","observation_id":"2e1bfbff-43c0-4b2f-9bfd-9a06b4a60566","resolution":{"observed_at":"2026-08-09T21:30:15.838186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.781520Z","title":"How Private Is Your RL Policy ? An Inverse RL Based Analysis Framework","venue":null,"work_id":"3d1f9593-2677-4c36-aa26-c27bd33e3d5b","year":2022},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.841902Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:2c1137aec11eb7a21582345863c3631a27c3ec1e8b571eadd3c6dba02c177cd0","observation_id":"6017f280-3641-4e94-907c-7589e015429c","resolution":{"observed_at":"2026-08-09T21:30:16.785031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.770760Z","title":"and Wang, Y","venue":null,"work_id":"0215fe2a-9980-4b35-bcad-9386ac98ee1d","year":2023},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.845374Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:80ebfabaff5e8267d607641baa4306a00eac4b75c896155f8b9d228315a79b67","observation_id":"e30f0d98-ab8b-415e-8429-642cc5cb1f48","resolution":{"observed_at":"2026-08-09T21:30:16.774343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.759947Z","title":"Reinforcement learning for personalized medication dosing, 2019","venue":null,"work_id":"dfa0ea3e-a34a-4f16-a04f-0b65b788c894","year":2019},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.849825Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:970c02bafbc8ac086f11104cc3181d2653ccd65a7b0ee62f3c7f8b532c928899","observation_id":"f40f9856-df6a-4fc4-b096-3ada96cd235f","resolution":{"observed_at":"2026-08-09T21:30:16.763780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.748392Z","title":"I., and Moritz, P","venue":null,"work_id":"67a99b45-50f2-4af7-8103-acc4d742479c","year":2015},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.853467Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:b020563565a8d5204441b83b30da849699c0a6e90c632c6093666970cff05de5","observation_id":"4cdd5c8e-4306-4e8a-86ea-a931f2194d69","resolution":{"observed_at":"2026-08-09T21:30:16.752890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T21:30:15.856751Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.856751Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:5dc21bdf8533ab6b72323238378c8a454e3c3d56c814c3a64b1fa9ca999bfcf4","observation_id":"58a94455-3690-4281-9df3-36c19eb107e1","resolution":{"observed_at":"2026-08-09T21:30:15.856751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.735896Z","title":null,"venue":null,"work_id":"8719e230-6d93-46d8-9093-945418a8b315","year":2014},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.860829Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:d7965ffc78f5c52944e8cdfed2865a2cfc2dcc2918b2dad2ac1151bac12dbe0e","observation_id":"e9ea94c5-e311-47c9-befe-9f8df2f49c1d","resolution":{"observed_at":"2026-08-09T21:30:16.739575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.724937Z","title":"S., McAllester, D","venue":null,"work_id":"d183c6c0-9223-4953-b67a-23e92799d58d","year":1999},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.864645Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:dce243d6e7658ed06d7bff7ed57f03ccee0581df8490395a04652ff45ed91080","observation_id":"bc2fa47c-523b-4442-8f80-2a4fbeb1b744","resolution":{"observed_at":"2026-08-09T21:30:16.728692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03539","last_updated":"2024-09-16T15:41:05Z","snapshot_observed_at":"2026-07-06T18:57:43.764663Z","submitted_at":"2024-08-07T04:35:38Z","title":"Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03539","snapshot_observed_at":"2026-08-09T21:30:15.868108Z","title":"Deep reinforcement learning for robotics: A survey of real-world successes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.868108Z"},"links":{"cited_paper":"/paper/2408.03539","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:de20279ccd5d4dc4d7dee31524ec19910593bdce337310287bb3c4e8ea9f8599","observation_id":"22933b28-81d1-46b0-9dda-b09224f8b04d","resolution":{"observed_at":"2026-08-09T21:30:15.868108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.712840Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"b0330c5f-d329-4e71-b7bb-85ce7d14f6c6","year":2012},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.872020Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:b6ecb8aeb4917db1211e2793c38f191b00ade87f7b1f2b6907674f79388b404c","observation_id":"37582d23-0789-4d06-866d-3238b0a7e8c8","resolution":{"observed_at":"2026-08-09T21:30:16.716513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.701912Z","title":null,"venue":null,"work_id":"a2ec18c4-2a9e-4df0-9e61-f32eac6dc94f","year":2020},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.875687Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:51ce5ac7673d582ba40ea234edb54c42d342a1c2c144cdf7787f017500cc5860","observation_id":"aeec1a33-2088-49cf-bc48-e0b0f1a7d00d","resolution":{"observed_at":"2026-08-09T21:30:16.705576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:16.690824Z","title":"and Hegde, N","venue":null,"work_id":"9f0beb33-6349-44c1-9b2c-9d1d8057cbb9","year":2019},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.879280Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:0d09f3bb2a10ae05e9476a75e8179cc9aff03c67b7f55a87f7fb8b4564e038f2","observation_id":"8c03bd35-273c-47b0-874b-f0d7ff36361e","resolution":{"observed_at":"2026-08-09T21:30:16.694584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15607/rss.2023.xix.102","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"baef9031-cd11-437f-a905-1bdb036289b8","year":2023},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.882631Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:180d67b6552450cf909aa04cea26b7b13ea873b731b5209aa91862535a2f0519","observation_id":"17b81c7b-481c-42d4-b074-7d85b34171d4","resolution":{"observed_at":"2026-08-09T21:30:15.929584Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:30:15.886181Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.886181Z"},"links":{"citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:79c97ea5957406d8604a5a720824bec8608d6765213dc05d1165c71223540a76","observation_id":"74eb0231-9a03-4bc4-ba59-572920e52a16","resolution":{"observed_at":"2026-08-09T21:30:15.886181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.12060","last_updated":"2019-12-07T04:13:50Z","snapshot_observed_at":"2026-08-01T19:51:17.902176Z","submitted_at":"2019-11-27T10:26:50Z","title":"Reviewing and Improving the Gaussian Mechanism for Differential Privacy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.12060","snapshot_observed_at":"2026-08-09T21:30:15.890050Z","title":"Reviewing and improving the gaussian mechanism for differential privacy","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T21:30:15.890050Z"},"links":{"cited_paper":"/paper/1911.12060","citing_paper":"/paper/2501.19080"},"observation_digest":"sha256:9c0f7cec50426ea520653ab43281980b05061a7c5ec9246cb9cb5842485f8c05","observation_id":"3f8eff11-ecdc-4938-999a-3c96d89310aa","resolution":{"observed_at":"2026-08-09T21:30:15.890050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.19080","last_updated":"2025-01-31T12:11:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T09:26:29.697492Z","submitted_at":"2025-01-31T12:11:13Z","title":"Differentially Private Policy Gradient"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":19,"verified_exact":4,"verified_fuzzy":15},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2501.19080."}