{"as_of":"2026-08-08T03:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:949f7c247b7863d34d27030d3dead9d8e076a5a345b673274b82ce70b8000a9f","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:43:15.053074Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22565/citation-record","integrity":"/paper/2507.22565/integrity","json":"/paper/2507.22565/citation-record.json","paper":"/paper/2507.22565"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:12.570822Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:12.570822Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:bfc4db79c24241f3a8e728e63927a92b55a86fba79944a52d170855fcb79a1d1","observation_id":"985350ad-256c-4aa8-8751-dc548b901d90","resolution":{"observed_at":"2026-08-06T11:43:12.570822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:12.612617Z","title":"Deep learning with differential privacy","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:12.612617Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:b451cf8cc997b6f67f4ebb0ddc6dbec7b0b82e2398af774212b5733b334260ae","observation_id":"8abdf2c0-ff0d-4328-b584-8b16e418028c","resolution":{"observed_at":"2026-08-06T11:43:12.612617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:12.726662Z","title":"Differentially private learning with adaptive clipping","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:12.726662Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:2ef523c40078b7977c9112a8b58f39c5e14206af0d76204b5016472a68e0478c","observation_id":"c2ad7d1f-ad3d-4308-b436-93d57a34eef6","resolution":{"observed_at":"2026-08-06T11:43:12.726662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:18.147981Z","title":"Automatic clipping: Differentially private deep learning made easier and stronger","venue":null,"work_id":"f9f9ef87-47f5-4f1c-bb4b-b76057e964d3","year":2023},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:12.800066Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:aba7a49d584e070a411a589e2651a892bdb805f3ef8f3a315d26323bdcff1519","observation_id":"7481d484-1591-426e-82c8-afeb2e7c19a9","resolution":{"observed_at":"2026-08-06T11:43:18.250651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:17.912110Z","title":"Membership inference attacks from first principles","venue":null,"work_id":"954bc27a-c252-4bf7-84ee-17e756becbb9","year":2022},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:12.862181Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:2a6762979dfe0e57d882a689ca397d4a41838e2a1c8905ba03604bbc157f45fc","observation_id":"3a0b9f5c-1b8c-47be-bf25-ec3c3eab7e36","resolution":{"observed_at":"2026-08-06T11:43:18.047519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T11:43:12.967584Z","title":"Albert q","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:12.967584Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:a3c64e7c6b38ad43f904442404ded9e8d94c3333505cb6945c91552b22f8e44a","observation_id":"ce092f6c-9284-4359-b047-a71a13aa548c","resolution":{"observed_at":"2026-08-06T11:43:12.967584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:17.617459Z","title":"Multi-step reinforcement learning: A unifying algorithm","venue":null,"work_id":"f77d474f-6846-4ccb-b4e7-f619ed960783","year":2018},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.067238Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:03abd0baf8bab8f58b17bfa4e130813802c148bc055da1a397241da5ab3c6be0","observation_id":"70ff7309-dae0-4229-b72b-eeddfdf19d6a","resolution":{"observed_at":"2026-08-06T11:43:17.746341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:17.406826Z","title":"Gaussian differential privacy","venue":null,"work_id":"db16e8cd-14d9-4e91-98bc-8207a3b49097","year":2022},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.147548Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:1a9070130c42c0c3d883c37575d45bf3aabe5da651265d922a0b1dee77d8f65a","observation_id":"a06448f1-1099-4dbb-9e67-8fd87682c41c","resolution":{"observed_at":"2026-08-06T11:43:17.488113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:13.296935Z","title":"The algorithmic foundations of differential privacy","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.296935Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:19dc4b0366986a36d76cd0470c4551d23033bb815e3ca821548857bf692a8909","observation_id":"e95ed40a-534f-4ff4-b1cf-721211ad5858","resolution":{"observed_at":"2026-08-06T11:43:13.296935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:13.372434Z","title":"Geoclip: Geometry-aware clipping for differentially private sgd","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.372434Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:05bcb592cb1d02b36317a1e3d240cd5f0e464db954ca2e18496c48b89fd14ef9","observation_id":"b31b0c60-b8fd-4864-b3e9-c0e71576566b","resolution":{"observed_at":"2026-08-06T11:43:13.372434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T11:43:13.448370Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.448370Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:d3caa57ffb2720f1d2e89dc3aea67092ea5162a0a77f2c2d0161df8e4352bb1e","observation_id":"821d5bc7-de37-45f2-90a9-d26c1435b8e7","resolution":{"observed_at":"2026-08-06T11:43:13.448370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:13.554740Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.554740Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:25a31aaa65354b9dbbcb8319208ff3d96ffe54db12781f30d1e5089cacbc2c02","observation_id":"387ec0f5-b0c5-4e01-a474-b56639255daf","resolution":{"observed_at":"2026-08-06T11:43:13.554740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:13.646796Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.646796Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:c841673885b3983127174f0d2b3a4d2ac4fdd2a60958fd23f95baf91b28e0dfa","observation_id":"7eb5c481-ebe8-4050-9e28-48272d85294a","resolution":{"observed_at":"2026-08-06T11:43:13.646796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05679","last_updated":"2022-11-10T18:42:34Z","snapshot_observed_at":"2026-07-06T11:56:47.302637Z","submitted_at":"2021-10-12T01:45:27Z","title":"Large Language Models Can Be Strong Differentially Private Learners","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05679","snapshot_observed_at":"2026-08-06T11:43:13.733634Z","title":"Large language models can be strong differentially private learners","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.733634Z"},"links":{"cited_paper":"/paper/2110.05679","citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:e3eb5949db49392acd67c906a1b91ef0d750e9c988db24e3c17fcc1b43e4a0bb","observation_id":"8bca0c17-51cb-458a-9840-25a16c71a938","resolution":{"observed_at":"2026-08-06T11:43:13.733634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:17.068515Z","title":"Wind power forecasting considering data privacy protection: A federated deep reinforcement learning approach","venue":null,"work_id":"dddaf680-30ba-47bf-bbaf-41be57855a41","year":2023},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.811261Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:00a1c125713af957206e7ad2c68ff8bdc32dd5313ce9215605cf3724567395f9","observation_id":"010f1573-043d-4ca0-bf7c-7d0bb339cff2","resolution":{"observed_at":"2026-08-06T11:43:17.202689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:16.807430Z","title":"Differentially private low-rank adaptation of large language model using federated learning","venue":null,"work_id":"02d2ae76-85ba-4d83-a743-17ad9ba320cf","year":2025},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:13.962028Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:ec26ad133990c91034cff5fac71dd3bb3dc2c7af6abb64dfd4460d47d88b480d","observation_id":"bc7500e7-d9b0-457f-bb50-8b587a07398e","resolution":{"observed_at":"2026-08-06T11:43:16.921676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:14.074621Z","title":"R \\'e nyi differential privacy","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.074621Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:5ffdb385c2df2a975886b8d7fbdfb38efc7369089bea8a57b95f49fed0b36fc8","observation_id":"c05df738-3665-4014-8263-831ce653ea69","resolution":{"observed_at":"2026-08-06T11:43:14.074621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.08908","last_updated":"2018-02-24T20:39:51Z","snapshot_observed_at":"2026-07-06T06:25:11.708379Z","submitted_at":"2018-02-24T20:39:51Z","title":"Scalable Private Learning with PATE","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.08908","snapshot_observed_at":"2026-08-06T11:43:14.189203Z","title":"Scalable private learning with pate","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.189203Z"},"links":{"cited_paper":"/paper/1802.08908","citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:295415511c3ad63c0773e7404ac7c5a221baa82b7188a876cb22d08a3106e5af","observation_id":"165e00b2-3671-43e1-8755-3b688ac4e943","resolution":{"observed_at":"2026-08-06T11:43:14.189203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07643","last_updated":"2019-10-23T19:02:00Z","snapshot_observed_at":"2026-08-08T00:40:41.624173Z","submitted_at":"2019-08-20T23:19:21Z","title":"AdaCliP: Adaptive Clipping for Private SGD","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07643","snapshot_observed_at":"2026-08-06T11:43:14.323680Z","title":"Adaclip: Adaptive clipping for private sgd","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.323680Z"},"links":{"cited_paper":"/paper/1908.07643","citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:37710243f0f76d2bd3d10663cc9a37308e84eb0da6c8035871d927449567f035","observation_id":"69586a21-e7e8-4143-8853-2aa87e115a5b","resolution":{"observed_at":"2026-08-06T11:43:14.323680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03888","last_updated":"2021-08-09T09:18:22Z","snapshot_observed_at":"2026-07-06T11:36:37.444791Z","submitted_at":"2021-08-09T09:18:22Z","title":"Efficient Hyperparameter Optimization for Differentially Private Deep Learning","version":1},"cited_work":{"arxiv_id":"2108.03888","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.03888","snapshot_observed_at":"2026-08-06T11:43:15.230327Z","title":"Efficient Hyperparameter Optimization for Differentially Private Deep Learning","venue":"cs.LG","work_id":"c8b8b25f-5f58-4c18-b137-68c21aaf98dd","year":2021},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.436089Z"},"links":{"cited_paper":"/paper/2108.03888","citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:757cc12e68fef9c99156768af976e022093266a85f03ff22b6c08c764775c136","observation_id":"4455fa88-68da-4aa4-874a-a79564985957","resolution":{"observed_at":"2026-08-06T11:43:15.351648Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:14.600661Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.600661Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:d124548fa4ffe9976281804305e06b8b9e25871b51d15db7ae1dbd579c29784e","observation_id":"6978fb2f-690e-4daf-a197-fc808abe7abd","resolution":{"observed_at":"2026-08-06T11:43:14.600661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:16.491459Z","title":"Dc-sgd: Differentially private sgd with dynamic clipping through gradient norm distribution estimation","venue":null,"work_id":"3ccad9cc-e3d0-4879-b9cd-e5f796df9dc0","year":2025},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.743165Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:671009296425804ddc19fad3853276748b91115821cf1490040d877cca392dc6","observation_id":"aaedad78-ee72-428c-b9de-c52db8c6ffd9","resolution":{"observed_at":"2026-08-06T11:43:16.642301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:16.262232Z","title":"Differentially private learning with per-sample adaptive clipping","venue":null,"work_id":"facfd89a-b993-4a37-ac12-ace5585e9f4a","year":2023},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.852777Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:a19fcb5c4d4c6972b85c2663267f4fb78578cc7d324438098d526736097c4fb9","observation_id":"bbb0f929-ebb7-45dc-b1cb-379a1eb11940","resolution":{"observed_at":"2026-08-06T11:43:16.374582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:16.029758Z","title":"A concurrent federated reinforcement learning for iot resources allocation with local differential privacy","venue":null,"work_id":"fefcd67c-9c9b-4d1c-b2aa-1a6d14944573","year":2023},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:14.931026Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:4d599b3208b386a9047c03b357933f6bcbff8519097a41ff1f809206e061916c","observation_id":"504d02dd-1eea-46d4-9f44-8abe8802c857","resolution":{"observed_at":"2026-08-06T11:43:16.137920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:43:15.780729Z","title":"Poission subsampled r \\'e nyi differential privacy","venue":null,"work_id":"60ba6ada-c4d0-4b66-8574-2ea436b3adb8","year":2019},"citing_paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T11:43:15.053074Z"},"links":{"citing_paper":"/paper/2507.22565"},"observation_digest":"sha256:eeafa85d74f2fcd7ad16091e521fdd3b1ef459a1492039d58a70c62e6000791b","observation_id":"3aae371a-4be4-4f1a-a4ef-c866171c9f65","resolution":{"observed_at":"2026-08-06T11:43:15.871149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22565","last_updated":"2025-07-30T10:46:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:36:25.180750Z","submitted_at":"2025-07-30T10:46:53Z","title":"Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2507.22565."}