{"as_of":"2026-08-07T11:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10dd1b33efe3f0829e6656871f02ddb25da3e000fd000c325f1250997645a34f","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:35:00.594186Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10536/citation-record","integrity":"/paper/2507.10536/integrity","json":"/paper/2507.10536/citation-record.json","paper":"/paper/2507.10536"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.416500Z","title":"Brendan McMahan, Ilya Mironov, Kunal Talwar, and Li Zhang","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.416500Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:39fe28c6561c6d04625c7eec6c673933666af6d66c3943c0a535d89ec412e377","observation_id":"a992f701-8020-40dc-8b91-8857adb02f3c","resolution":{"observed_at":"2026-08-06T17:35:00.416500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.805777Z","title":"Scalable sec- ond order optimization for deep learning, 2021","venue":null,"work_id":"ad65948c-afb8-4ae2-bf49-913e7e3ac625","year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.420787Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:244f1f3da635d372310979c8534dbf8fbeb52c9c328d44ab941859d552ccb34c","observation_id":"2e934b2d-0e85-4b31-9c3f-849976e802b3","resolution":{"observed_at":"2026-08-06T17:35:00.808225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T17:35:00.426132Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.426132Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:ecf04aea5a26f32164ea4ebdb7913a03a3005610b5a2af9c632027468c7a7486","observation_id":"77948df8-f2ae-4a6a-9eeb-3f0a4ab7d5c2","resolution":{"observed_at":"2026-08-06T17:35:00.426132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.798984Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":"8125a3fb-dfeb-4071-96fa-561d3b8e499a","year":2011},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.441086Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:4aee6a784f157ef04e74a9fb90241f13e241c1f3bf4091f1b2ed47b3a0b9441a","observation_id":"1c2f29fd-3204-4f81-b0f3-ed1ae42bbcf6","resolution":{"observed_at":"2026-08-06T17:35:00.801586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T17:35:00.468978Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.468978Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:62aa22f1b9680bcc6438aa1f5445b3b18838d08d95fcbb9c7bd0b5235efa70cc","observation_id":"9591ba3a-046d-4fdd-989b-9782a552fd3e","resolution":{"observed_at":"2026-08-06T17:35:00.468978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T17:35:00.483545Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.483545Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:c5ee093d497b33b5816023462b6003e375fc7f6a396251c30c24f46c681141f1","observation_id":"1ad4f1b9-5674-4d76-91bc-8bebd22b79a5","resolution":{"observed_at":"2026-08-06T17:35:00.483545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13960","last_updated":"2023-04-27T05:41:13Z","snapshot_observed_at":"2026-08-02T07:55:35.655526Z","submitted_at":"2023-04-27T05:41:13Z","title":"Noise Is Not the Main Factor Behind the Gap Between SGD and Adam on Transformers, but Sign Descent Might Be","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13960","snapshot_observed_at":"2026-08-06T17:35:00.502564Z","title":"Noise is not the main factor behind the gap between sgd and adam on transformers, but sign descent might be, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.502564Z"},"links":{"cited_paper":"/paper/2304.13960","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:c792be1e9398abc0ca1758c2ba75220230b276263958ce43074c170b084e82f3","observation_id":"c0083046-e54e-499b-8941-7fc4662516be","resolution":{"observed_at":"2026-08-06T17:35:00.502564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19449","last_updated":"2024-07-12T05:10:32Z","snapshot_observed_at":"2026-07-06T17:37:39.610989Z","submitted_at":"2024-02-29T18:47:52Z","title":"Heavy-Tailed Class Imbalance and Why Adam Outperforms Gradient Descent on Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19449","snapshot_observed_at":"2026-08-06T17:35:00.523005Z","title":"Heavy- tailed class imbalance and why adam outperforms gradient descent on language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.523005Z"},"links":{"cited_paper":"/paper/2402.19449","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:1cb46f659ab2e141f265b288727284289767e7257ac729cd8ce78582da0ec4c8","observation_id":"804db7b2-bcdb-4899-85ca-a5638c30b740","resolution":{"observed_at":"2026-08-06T17:35:00.523005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08249","last_updated":"2023-10-01T18:34:20Z","snapshot_observed_at":"2026-08-05T21:16:18.814991Z","submitted_at":"2020-04-17T13:59:07Z","title":"Understanding the Difficulty of Training Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08249","snapshot_observed_at":"2026-08-06T17:35:00.542162Z","title":"Understanding the difficulty of training transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.542162Z"},"links":{"cited_paper":"/paper/2004.08249","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:650d31d43ddbd84aaf4dace980ce3bbf0796a79c6aa010e4bfe17ce7f3acfc9b","observation_id":"6f731f1d-530c-464c-84b5-096da2279561","resolution":{"observed_at":"2026-08-06T17:35:00.542162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.05671","last_updated":"2020-06-08T01:28:58Z","snapshot_observed_at":"2026-08-01T17:05:24.402816Z","submitted_at":"2015-03-19T08:30:24Z","title":"Optimizing Neural Networks with Kronecker-factored Approximate Curvature","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.05671","snapshot_observed_at":"2026-08-06T17:35:00.556327Z","title":"Optimizing neural networks with kronecker-factored approx- imate curvature, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.556327Z"},"links":{"cited_paper":"/paper/1503.05671","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:7ab7f0dbf9578e5da162300bfafa54356f668dda640efa5e07a66de626e803a4","observation_id":"d774b2d5-52cb-424f-847d-609911d2e59c","resolution":{"observed_at":"2026-08-06T17:35:00.556327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12506","last_updated":"2022-11-04T03:13:41Z","snapshot_observed_at":"2026-08-06T14:39:03.092080Z","submitted_at":"2022-05-25T05:49:31Z","title":"Memorization in NLP Fine-tuning Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12506","snapshot_observed_at":"2026-08-06T17:35:00.577638Z","title":"Memorization in nlp fine-tuning methods, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.577638Z"},"links":{"cited_paper":"/paper/2205.12506","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:43111849ce6c6151a1b1e0f4089b25af81a91b47d44922a398a4d9d9de5aee48","observation_id":"120019b7-ce92-47c9-9947-8df7d4ec3ba9","resolution":{"observed_at":"2026-08-06T17:35:00.577638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.09254","last_updated":"2017-07-06T11:51:09Z","snapshot_observed_at":"2026-07-06T05:48:48.685757Z","submitted_at":"2017-06-28T12:38:53Z","title":"The E2E Dataset: New Challenges For End-to-End Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.09254","snapshot_observed_at":"2026-08-06T17:35:00.580123Z","title":"The e2e dataset: New challenges for end-to-end generation, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.580123Z"},"links":{"cited_paper":"/paper/1706.09254","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:bb46c969e92cefb4decf9339791fe8c5147310152785b014477a6be5c78c5b50","observation_id":"7d3e614e-c18c-4e5c-ba14-080fc4a61c8b","resolution":{"observed_at":"2026-08-06T17:35:00.580123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16382","last_updated":"2024-04-15T22:34:22Z","snapshot_observed_at":"2026-08-06T16:59:42.471139Z","submitted_at":"2023-07-31T03:17:51Z","title":"Does fine-tuning GPT-3 with the OpenAI API leak personally-identifiable information?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16382","snapshot_observed_at":"2026-08-06T17:35:00.582631Z","title":"Does fine-tuning gpt-3 with the openai api leak personally-identifiable information?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.582631Z"},"links":{"cited_paper":"/paper/2307.16382","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:c8274b37ea2d54487813b474c4532c18886a6cf93165fbbe0fec9bf46341cf79","observation_id":"49d4fa1a-4059-4975-ba31-c28d13c79a9f","resolution":{"observed_at":"2026-08-06T17:35:00.582631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14334","last_updated":"2023-12-21T23:42:00Z","snapshot_observed_at":"2026-08-05T09:49:54.277456Z","submitted_at":"2023-12-21T23:42:00Z","title":"DP-AdamBC: Your DP-Adam Is Actually DP-SGD (Unless You Apply Bias Correction)","version":1},"cited_work":{"arxiv_id":"2312.14334","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.14334","snapshot_observed_at":"2026-08-06T17:35:00.637029Z","title":"DP-AdamBC: Your DP-Adam Is Actually DP-SGD (Unless You Apply Bias Correction)","venue":"cs.LG","work_id":"49ae6693-f118-4766-bef8-3935af457b51","year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.585245Z"},"links":{"cited_paper":"/paper/2312.14334","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:84ff78463143dcd566dd07ae2995ffaf95fe9253d340f4d5b493f09ab7038289","observation_id":"54e0f782-48ec-430a-818a-6795c9ddcde4","resolution":{"observed_at":"2026-08-06T17:35:00.639766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12475","last_updated":"2023-05-21T14:40:43Z","snapshot_observed_at":"2026-07-06T15:30:18.137347Z","submitted_at":"2023-05-21T14:40:43Z","title":"Two Sides of One Coin: the Limits of Untuned SGD and the Power of Adaptive Methods","version":1},"cited_work":{"arxiv_id":"2305.12475","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12475","snapshot_observed_at":"2026-08-06T17:35:00.625994Z","title":"Two Sides of One Coin: the Limits of Untuned SGD and the Power of Adaptive Methods","venue":"math.OC","work_id":"4686ec59-66c9-45d2-882c-2dfe0a8ac3fe","year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.587177Z"},"links":{"cited_paper":"/paper/2305.12475","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:644aaec978bb5bb88d9e78231423aeb8344ce4da9cdaebc92efafdbf78a13426","observation_id":"d2d3ba6f-77b1-4448-bdb3-b3e4e9eeb817","resolution":{"observed_at":"2026-08-06T17:35:00.630475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06500","last_updated":"2022-07-14T22:14:17Z","snapshot_observed_at":"2026-07-06T11:57:21.548494Z","submitted_at":"2021-10-13T05:15:00Z","title":"Differentially Private Fine-tuning of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06500","snapshot_observed_at":"2026-08-06T17:35:00.589460Z","title":"Inan, Gautam Kamath, Janardhan Kulkarni, Yin Tat Lee, Andre Manoel, Lukas Wutschitz, Sergey Yekhanin, and Huishuai Zhang","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.589460Z"},"links":{"cited_paper":"/paper/2110.06500","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:48b2679df5cb59709d0e9f9f7ddc13c9cd6df26870d4a83217d5cf7d4ee02e40","observation_id":"db00a1ec-2ecd-4c95-a287-a58f604edc16","resolution":{"observed_at":"2026-08-06T17:35:00.589460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.03194","last_updated":"2020-10-23T08:07:04Z","snapshot_observed_at":"2026-08-02T08:10:10.416307Z","submitted_at":"2019-12-06T15:58:29Z","title":"Why are Adaptive Methods Good for Attention Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.03194","snapshot_observed_at":"2026-08-06T17:35:00.591858Z","title":"Why are adaptive methods good for attention models?, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.591858Z"},"links":{"cited_paper":"/paper/1912.03194","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:69776488d6a9ada5d27acd44cb555a83783bffb859fafce96a4467a6dd4cccfe","observation_id":"0351a6d9-9cd4-48a8-8d70-89e37877fdaf","resolution":{"observed_at":"2026-08-06T17:35:00.591858Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.792370Z","title":null,"venue":null,"work_id":"78e35b0c-1a76-4c02-988b-675cfb386aa3","year":null},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.594186Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:6d14600720fdad45d54e07d9edf99f10b1f9011da69cb69855e65c7bbb91c743","observation_id":"06846fe7-9227-4269-b8c9-42b55fc3c2ec","resolution":{"observed_at":"2026-08-06T17:35:00.794589Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2507.10536."}