{"as_of":"2026-08-07T23:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a58b04244f4faa12bc55b680817972d6561479e809a29a95776d9a33a7a26bb","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:02:11.666342Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T06:10:20.420575Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04059","snapshot_observed_at":"2026-08-03T06:10:20.420575Z","title":"Attributing data for sharpness-aware minimization.CoRR, abs/2507.04059, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00329","last_updated":"2026-07-22T02:36:11Z","snapshot_observed_at":"2026-08-07T12:31:48.020973Z","submitted_at":"2026-01-30T21:31:40Z","title":"In-Run Data Shapley for Adam Optimizer","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T06:10:20.420575Z"},"links":{"cited_paper":"/paper/2507.04059","citing_paper":"/paper/2602.00329"},"observation_digest":"sha256:4bb7709be5915f8f19f19c098b868a66d8f8115f578ef7c382e4acfb4137ce48","observation_id":"1319ece6-7896-4d51-b873-a37d8ec87ba1","resolution":{"observed_at":"2026-08-03T06:10:20.420575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04059/citation-record","integrity":"/paper/2507.04059/integrity","json":"/paper/2507.04059/citation-record.json","paper":"/paper/2507.04059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.466300Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":"dc6b7c69-1e0f-4dbe-986e-11eca399e9f9","year":2009},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.687671Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:e6d71c29e782ca1a18b83ff4aeb8e52dbfc82ed96c7f797abf7da86c825e2578","observation_id":"6f5959e9-00f7-4383-a952-a736e878d95d","resolution":{"observed_at":"2026-08-06T20:02:12.469258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.459160Z","title":"Sharpness- aware minimization leads to low-rank features","venue":null,"work_id":"41522456-1d0b-4ef6-915e-fd75ebc62996","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.728346Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c4c305d736fcec88b0631c0c6b2ce95c7be3bb88ae8dd63a18122de77489fc36","observation_id":"27883883-6e69-4837-949e-66c2e89b8318","resolution":{"observed_at":"2026-08-06T20:02:12.461558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.451417Z","title":"Towards understanding sharpness-aware minimization","venue":null,"work_id":"dc3205c2-4738-4561-aec5-92d0234f41ff","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.772885Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:86856e058946f16203d78df2dbe466afdb0a6faea9ea75d262ceca031fadf9e4","observation_id":"7151007d-0620-479d-950f-85a539aadbbf","resolution":{"observed_at":"2026-08-06T20:02:12.454197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08529","last_updated":"2022-03-15T23:33:33Z","snapshot_observed_at":"2026-08-02T12:28:08.766206Z","submitted_at":"2021-10-16T09:44:06Z","title":"Sharpness-Aware Minimization Improves Language Model Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08529","snapshot_observed_at":"2026-08-06T20:02:05.826901Z","title":"Sharpness-aware minimization improves language model generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.826901Z"},"links":{"cited_paper":"/paper/2110.08529","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:b6a46eb5ed031230066a696b033ac6296ff5520446accac8eb0e88beb36df70d","observation_id":"de2c7554-1a22-4484-8dce-d62dc30addc4","resolution":{"observed_at":"2026-08-06T20:02:05.826901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.442947Z","title":"Influence functions in deep learning are fragile","venue":null,"work_id":"586c162d-5e82-40ff-9569-ddc6e3bd0d81","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.859848Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:96eaa5ae3a355f46ad5570addc25f48b1f1a00ddbf7195b9622a5541ee4de10f","observation_id":"eb8c36a8-eac8-4d0c-a3b6-b4bd61961f5b","resolution":{"observed_at":"2026-08-06T20:02:12.445685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.434759Z","title":"Un- derstanding the origins of bias in word embeddings","venue":null,"work_id":"cdac60f4-a542-49de-8fd4-3850d334bbb8","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.911916Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:5dd34c01f1fcab3d0a2d6c7ea54f8561d731f307907b8261fae01aef0d2cd9c5","observation_id":"80785932-dfa7-4f1b-bb93-c98df5824275","resolution":{"observed_at":"2026-08-06T20:02:12.437631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.426520Z","title":"Entropy-sgd: Biasing gradient descent into wide valleys","venue":null,"work_id":"dc2da23d-f1af-4f84-ba59-1f5d31ff8a33","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:05.969780Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:dc7361134c3ee9003f9ef4dcc266eeccde0ed53a7270f1cf9683692658d87922","observation_id":"8a77e1ce-6da6-4f5c-95b2-77f6a743b59f","resolution":{"observed_at":"2026-08-06T20:02:12.429482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.418171Z","title":"Multi-stage influence function","venue":null,"work_id":"b52ba6bc-9cc0-4188-b629-3d7027e2eaec","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.009181Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:d376ec21127c21b1cc7523896bd62594c8f60c250688c1fe56e080e028233d17","observation_id":"d8c30c5c-9c6a-49a9-97db-d35645608096","resolution":{"observed_at":"2026-08-06T20:02:12.420819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01548","last_updated":"2022-03-13T18:58:43Z","snapshot_observed_at":"2026-07-06T11:15:26.915483Z","submitted_at":"2021-06-03T02:08:03Z","title":"When Vision Transformers Outperform ResNets without Pre-training or Strong Data Augmentations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01548","snapshot_observed_at":"2026-08-06T20:02:06.057895Z","title":"When vision transformers outperform resnets without pre-training or strong data augmentations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.057895Z"},"links":{"cited_paper":"/paper/2106.01548","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:20bb37a3399b9f0669771dc036f0a6bba35a6cfdaaaa9f872378437505294340","observation_id":"29ed7f32-3fd8-434c-a9c0-0bbfff544124","resolution":{"observed_at":"2026-08-06T20:02:06.057895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.409609Z","title":"Detection of influential observation in linear regression","venue":null,"work_id":"faf18169-f878-43db-9bab-932a71d1ee3c","year":2000},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.113595Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:35db56157507b678686d86f22da34f44dfa9e77ea86887fc9ee7802d8ce5b0a5","observation_id":"5c7b5b88-1fbc-48eb-a530-17ca61fe7b25","resolution":{"observed_at":"2026-08-06T20:02:12.412580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:06.162305Z","title":"Characterizations of an empirical influence function for detecting influential cases in regression","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.162305Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:450a3fd86141b8564c24ddcff748cf8a9e34a209fdea35c8529cdcb2cb8000a2","observation_id":"048ed343-a8f1-4d08-854e-d49f4fd97bde","resolution":{"observed_at":"2026-08-06T20:02:06.162305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.395676Z","title":"The theory of max-min and its application to weapons allocation problems, volume 5","venue":null,"work_id":"242a64a8-c032-486e-83a9-57445c5df58e","year":2012},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.225748Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:e8494e0b0b668b8a0b6edeb5637358b3d55f0e9ab7d792d7c4082a2e7676939a","observation_id":"9d5e6f38-e7be-4ff4-b143-7394496a681a","resolution":{"observed_at":"2026-08-06T20:02:12.398197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.388219Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":"1b812ffc-1728-4cf6-b060-81eac313fa74","year":2009},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.286092Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:73ef737fc82da541bb79419322e56b0b60bbfd5ae355b23706c09a94fbbfd42d","observation_id":"df0102a3-ee11-4b5e-bcdc-7cb2f780ceab","resolution":{"observed_at":"2026-08-06T20:02:12.390661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03141","last_updated":"2022-05-28T15:35:32Z","snapshot_observed_at":"2026-08-07T22:49:31.348973Z","submitted_at":"2021-10-07T02:20:37Z","title":"Efficient Sharpness-aware Minimization for Improved Training of Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.03141","snapshot_observed_at":"2026-08-06T20:02:06.339881Z","title":"Efficient sharpness-aware minimization for improved training of neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.339881Z"},"links":{"cited_paper":"/paper/2110.03141","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:3299837eea107156cc87cf740657b33444bd5a82ea7f08ae31b9ef0a6f1132a9","observation_id":"07d788d8-3dee-4b27-bb15-8a3b6d7e6505","resolution":{"observed_at":"2026-08-06T20:02:06.339881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.380065Z","title":"What neural networks memorize and why: Discovering the long tail via influence estimation","venue":null,"work_id":"32f3713f-4c3e-4771-a062-c12612ecd119","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.402965Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:accc98069f1d87cb4a235eddc7ccaf4e13b4e0fa9fce2122998006c5aab2393d","observation_id":"58481b64-b0f2-4da2-b2a1-bf0a7f0c257a","resolution":{"observed_at":"2026-08-06T20:02:12.382538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01412","last_updated":"2021-04-29T16:44:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-03T19:02:10Z","title":"Sharpness-Aware Minimization for Efficiently Improving Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01412","snapshot_observed_at":"2026-08-06T20:02:06.457173Z","title":"Sharpness-aware mini- mization for efficiently improving generalization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.457173Z"},"links":{"cited_paper":"/paper/2010.01412","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:18bfa36298e4b1f9e8f1642c3d4385a75ecfe347f17cd41625c1e6af836cec12","observation_id":"ac30bb66-b358-40ba-84b9-f0d114410d00","resolution":{"observed_at":"2026-08-06T20:02:06.457173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:06.514723Z","title":"short-length","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.514723Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:5f09f2d1f50846ae6a0a98a6b33eec4552c134c7d620b6a3b5c20cb00724ac25","observation_id":"34dcc8fb-aa5b-4c91-b2da-bcb2bd00e370","resolution":{"observed_at":"2026-08-06T20:02:06.514723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06112","last_updated":"2024-02-04T16:31:50Z","snapshot_observed_at":"2026-08-07T22:49:29.672224Z","submitted_at":"2023-10-09T19:40:25Z","title":"Theoretical Analysis of Robust Overfitting for Wide DNNs: An NTK Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06112","snapshot_observed_at":"2026-08-06T20:02:06.580845Z","title":"Theoretical analysis of robust overfitting for wide dnns: An ntk approach","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.580845Z"},"links":{"cited_paper":"/paper/2310.06112","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:7c00cb2f97ce436e6a33c372e95cfe80a45f809eeec71e83b110e4fc109fc0f3","observation_id":"af93d81d-0306-47f6-bd26-9657bf65f60a","resolution":{"observed_at":"2026-08-06T20:02:06.580845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.372069Z","title":"Data shapley: Equitable valuation of data for machine learning","venue":null,"work_id":"c9ac0c45-3157-4be0-9ce4-91adb2be436d","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.695792Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:47b065be10e45fceb4edc4cba385d6067a533b73855f4a61cb86d19b55f8cc25","observation_id":"45104d74-4a91-4ee2-accc-1f2ff0ae1315","resolution":{"observed_at":"2026-08-06T20:02:12.374728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.363766Z","title":"Mixed-privacy forgetting in deep networks","venue":null,"work_id":"0c79aae1-40bf-4a23-881a-df5c82581a78","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.834811Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:14c145f5721ae49bc9b152623657cabb212cc064125fd091740091913476db7f","observation_id":"fefbba0b-5f41-4150-a07f-7b03a7de729b","resolution":{"observed_at":"2026-08-06T20:02:12.366501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:06.942920Z","title":"Eternal sunshine of the spotless net: Selective forgetting in deep networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:06.942920Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:74a535de249faf55cc17d16749b20dfb719ff2745e1a2d127d5b67bca10ccde0","observation_id":"1e9fa2d3-fb8d-4ea7-9f32-c7462c6b87cc","resolution":{"observed_at":"2026-08-06T20:02:06.942920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.06676","last_updated":"2020-05-14T00:45:23Z","snapshot_observed_at":"2026-08-07T22:49:28.848235Z","submitted_at":"2020-05-14T00:45:23Z","title":"Explaining Black Box Predictions and Unveiling Data Artifacts through Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.06676","snapshot_observed_at":"2026-08-06T20:02:07.027256Z","title":"Explaining black box predictions and unveiling data artifacts through influence functions","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.027256Z"},"links":{"cited_paper":"/paper/2005.06676","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:18ef4ef83080e8a7ec19cca5ba22c976a4c95cf83d1fcea80367f5ee2d924aeb","observation_id":"4577a052-ab1f-4dc8-a192-a4e13b33e542","resolution":{"observed_at":"2026-08-06T20:02:07.027256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:07.134012Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.134012Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:13b5b0250f57af7cdf80caa9f0a3cb84ae4c3a08bdf11b9ae3a24f4ad79a8b9b","observation_id":"4852de92-2d25-43a5-aefb-ea73dcefb76e","resolution":{"observed_at":"2026-08-06T20:02:07.134012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.346437Z","title":"Simplifying neural nets by discovering flat minima","venue":null,"work_id":"e463b724-06d5-4538-aaff-76a803efed68","year":1994},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.179033Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:62d74597ed178dfddd963d9a7e24b7540202c2f0f37f64b91e21ce8a785ceddf","observation_id":"8b8cf768-3308-4c38-86a9-b109949be359","resolution":{"observed_at":"2026-08-06T20:02:12.349001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.338684Z","title":"Flat minima","venue":null,"work_id":"313eb118-c35e-442d-8fb1-9c01762e61fd","year":1997},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.257961Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:726a0d00a4682645ad294793f23f536caebe3343d930e9addcf1b6d0835231ba","observation_id":"c5c42590-f4f3-4a24-be94-87a9b4c8e09e","resolution":{"observed_at":"2026-08-06T20:02:12.341015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09112","last_updated":"2023-10-23T13:28:35Z","snapshot_observed_at":"2026-08-07T22:49:31.526136Z","submitted_at":"2023-01-22T12:29:03Z","title":"Differentially Private Natural Language Models: Recent Advances and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09112","snapshot_observed_at":"2026-08-06T20:02:07.325958Z","title":"Differentially private natural language models: Recent advances and future directions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.325958Z"},"links":{"cited_paper":"/paper/2301.09112","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:237264e81f8da7d9cd644c11e62c22a6f17068a18430f3177a3ad4522c73e954","observation_id":"ceb13d4c-9935-4cab-b87f-5da93ea611cc","resolution":{"observed_at":"2026-08-06T20:02:07.325958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15476","last_updated":"2025-02-01T12:03:52Z","snapshot_observed_at":"2026-08-07T22:49:28.669491Z","submitted_at":"2024-05-24T11:55:46Z","title":"Editable Concept Bottleneck Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15476","snapshot_observed_at":"2026-08-06T20:02:07.414490Z","title":"Editable concept bottleneck models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.414490Z"},"links":{"cited_paper":"/paper/2405.15476","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:44412b8ac82a17dc7d6ce92064584291322daf7463a7b11fd07e623e266ebfec","observation_id":"14043fd2-e6a2-4972-9376-a0a116b34c49","resolution":{"observed_at":"2026-08-06T20:02:07.414490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11667","last_updated":"2025-01-31T23:36:04Z","snapshot_observed_at":"2026-08-07T22:49:30.899021Z","submitted_at":"2024-11-18T15:45:41Z","title":"Dissecting Representation Misalignment in Contrastive Learning via Influence Function","version":2},"cited_work":{"arxiv_id":"2411.11667","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11667","snapshot_observed_at":"2026-08-06T20:02:12.020561Z","title":"Dissecting Representation Misalignment in Contrastive Learning via Influence Function","venue":"cs.LG","work_id":"ab06afe7-3785-4c7a-9b34-6ea5bf667638","year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.522251Z"},"links":{"cited_paper":"/paper/2411.11667","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c923afea20d6dd6e4a90132a15a4417763a4f55aacf9ee11fed0b6cdb34d2b0c","observation_id":"e411ff96-d8af-47fb-9a85-b01dbc310002","resolution":{"observed_at":"2026-08-06T20:02:12.023582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.329893Z","title":"Privacy-preserving sparse generalized eigenvalue problem","venue":null,"work_id":"cf03575c-a2cd-456f-8ffe-c0da2de08654","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.640176Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:597a9a5bfbecf8e8f59d1c12ceeb43d40423ff249aa86e5b9e55a11717fd5cd4","observation_id":"b399b709-3eb6-4760-a73c-454f5dcf346a","resolution":{"observed_at":"2026-08-06T20:02:12.333177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.322107Z","title":"Robust statistics","venue":null,"work_id":"9e713c23-a3e6-4916-aaea-f7a2f21211d6","year":1981},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.767171Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:58e3a55aa98761ac52b6cc87f5fdf2c1db1c3d7aab3fa92e91ed837319ba56b1","observation_id":"338bb633-edbf-49a5-959e-518f0dde7d02","resolution":{"observed_at":"2026-08-06T20:02:12.324586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05407","last_updated":"2019-02-25T14:18:11Z","snapshot_observed_at":"2026-07-31T19:09:21.589864Z","submitted_at":"2018-03-14T17:09:27Z","title":"Averaging Weights Leads to Wider Optima and Better Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05407","snapshot_observed_at":"2026-08-06T20:02:07.851201Z","title":"Averaging weights leads to wider optima and better generalization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.851201Z"},"links":{"cited_paper":"/paper/1803.05407","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:eeaffa2d4b15fdef92f6dcac237bc63356bb688784f80eb90c0ae7d1b3d6461a","observation_id":"37f4b75e-6887-49dc-906b-2c603f442a4e","resolution":{"observed_at":"2026-08-06T20:02:07.851201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.313984Z","title":"Towards efficient data valuation based on the shapley value","venue":null,"work_id":"6e08d8d1-8559-42ea-86cf-9d41ea88f065","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:07.936269Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:3337cfef4307d589a99d351317277b1aac2345d92d557db091fad81c9c2cbcef","observation_id":"6c64f9eb-b518-46f4-92f9-5df8936890c2","resolution":{"observed_at":"2026-08-06T20:02:12.317442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04836","last_updated":"2017-02-09T20:38:16Z","snapshot_observed_at":"2026-07-06T05:10:58.923264Z","submitted_at":"2016-09-15T20:03:06Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04836","snapshot_observed_at":"2026-08-06T20:02:08.019516Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.019516Z"},"links":{"cited_paper":"/paper/1609.04836","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:27efa9ee7da0a65b34e8073fc75cf39425323e0a5b57a4d60ea5e2548b1c3f6c","observation_id":"ed265c71-12fa-42f3-a4b3-3b44f53ef3aa","resolution":{"observed_at":"2026-08-06T20:02:08.019516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.305648Z","title":"Understanding black-box predictions via influence functions","venue":null,"work_id":"fa2db8d8-6640-433b-99d0-1cda425c6ca4","year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.126788Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:8274959e9b14deb8a36ca9cc152ab71ee212602e19173bff71a7a0f5ab546951","observation_id":"56e007d7-1c49-44d4-9134-b4c86189fd0c","resolution":{"observed_at":"2026-08-06T20:02:12.308237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.297530Z","title":"Asam: Adaptive sharpness- aware minimization for scale-invariant learning of deep neural networks","venue":null,"work_id":"76d85a3c-9b5a-477d-804d-6fc454b833bd","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.286599Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:d88e5d9f6ec7bd9af85f1f1d799935d43b5fd5555f14c952b2e85459f55c8484","observation_id":"000ae659-333b-4d01-bf6b-281ea6be1bc0","resolution":{"observed_at":"2026-08-06T20:02:12.300520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.290127Z","title":"Beta shapley: a unified and noise-reduced data valuation framework for machine learning","venue":null,"work_id":"eb159182-4b0c-4390-9019-29830793fde3","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.456622Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:7cd00344e6eeaddbb37599654e92b2795d397d3b0db4d67a032c6172c0f8187c","observation_id":"0a96316d-bac3-41a6-b65b-1b0210b78628","resolution":{"observed_at":"2026-08-06T20:02:12.292687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:08.552605Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.552605Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:36d07ebc6ca594a58a227ee58d2408790e39b9ad91e8e99faf16aef207ca61f0","observation_id":"a0ca9953-b2a0-4237-bd03-1c3a585386d9","resolution":{"observed_at":"2026-08-06T20:02:08.552605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.277833Z","title":"Taad: Time-varying adversarial anomaly detection in dynamic graphs","venue":null,"work_id":"ec9516ee-9539-40af-95a7-4ce9543d1a4a","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.638083Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:7b3b4e1ab05205547b22a65e3423b3e40e1361f876bf9291470fea8cbbb6fdae","observation_id":"691b1a41-aa55-4669-8122-475aee919661","resolution":{"observed_at":"2026-08-06T20:02:12.280398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:08.701477Z","title":"Certified minimax unlearning with generalization rates and deletion capacity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.701477Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:ad2319dad0f0b3dc5f428de61175724de35ca43d5b1059a631987fafbc8caca8","observation_id":"1df482fe-a191-4299-af0f-4b227a07717a","resolution":{"observed_at":"2026-08-06T20:02:08.701477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10468","last_updated":"2024-09-05T15:47:45Z","snapshot_observed_at":"2026-08-07T22:51:48.145160Z","submitted_at":"2024-08-20T00:40:49Z","title":"Tracing Privacy Leakage of Language Models to Training Data via Adjusted Influence Functions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10468","snapshot_observed_at":"2026-08-06T20:02:08.850086Z","title":"Tracing privacy leakage of language models to training data via adjusted influence functions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.850086Z"},"links":{"cited_paper":"/paper/2408.10468","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c129168cd030e4c7362afaf2e3ddd8480eb3f9b481ba95cc850f09fd6f447a6d","observation_id":"11560f73-d871-4cce-99cf-ac5ce6f6818a","resolution":{"observed_at":"2026-08-06T20:02:08.850086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.265416Z","title":"Towards efficient and scalable sharpness-aware minimization","venue":null,"work_id":"c0d58245-2539-4339-a175-584166ae9968","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:08.954553Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:b1cc16cbb6b4aec1aa8a64ce5a7e9821548f133763031b1ab5ec6b44fa69d3ce","observation_id":"389afcc4-152d-4a6e-ba8a-fb90cbe1a25e","resolution":{"observed_at":"2026-08-06T20:02:12.267890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07874","last_updated":"2017-11-25T03:53:32Z","snapshot_observed_at":"2026-07-06T05:43:42.722222Z","submitted_at":"2017-05-22T17:38:10Z","title":"A Unified Approach to Interpreting Model Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07874","snapshot_observed_at":"2026-08-06T20:02:09.042708Z","title":"A unified approach to interpreting model predictions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.042708Z"},"links":{"cited_paper":"/paper/1705.07874","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:6cf28c939fe67665fc86abd3a1013813e99e7a76ab48a75194523ac9d5b9902b","observation_id":"96f613c4-c8e5-4399-85a7-83ef8ab13c20","resolution":{"observed_at":"2026-08-06T20:02:09.042708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.256623Z","title":"Privacy-preserving low-rank adaptation against membership inference attacks for latent diffusion models","venue":null,"work_id":"f9aa00cf-1214-411c-b889-efcff324f4e6","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.142122Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:a8cf0b6c6eda56e4772982f97d9c71d4e5e05fb9b1cd9780f5803745b448bc27","observation_id":"faf44026-f3e5-4a38-b75b-4cbde63faadc","resolution":{"observed_at":"2026-08-06T20:02:12.259962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.270948Z","title":"Towards deep learning models resistant to adversarial attacks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.270948Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:4103172e0f6f26c202de8cae5619a2843d66648bd1eec0bbf2dfc8ff72cb3e80","observation_id":"cf81a162-dc17-49fc-8a3a-7ce8ea59d820","resolution":{"observed_at":"2026-08-06T20:02:09.270948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.331386Z","title":"Exploring generalization in deep learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.331386Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:f0c2c155432504aa00ed01a608a7166e34e64bf00b00e44c9ef1785478550901","observation_id":"5630248e-072e-498f-9b80-6f88c8f08d67","resolution":{"observed_at":"2026-08-06T20:02:09.331386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14186","last_updated":"2023-04-03T17:37:50Z","snapshot_observed_at":"2026-08-07T22:49:29.096522Z","submitted_at":"2023-03-24T17:56:22Z","title":"TRAK: Attributing Model Behavior at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14186","snapshot_observed_at":"2026-08-06T20:02:09.426200Z","title":"Trak: Attributing model behavior at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.426200Z"},"links":{"cited_paper":"/paper/2303.14186","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c874991f2f37085589432c02bb212054c914a590dcea9666c2493b0a54d804e1","observation_id":"c18e484c-500f-41e8-93cd-d21c6f3ef836","resolution":{"observed_at":"2026-08-06T20:02:09.426200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.555002Z","title":"Estimating training data influence by tracing gradient descent","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.555002Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:85c33ff8ecc866f77b779127d37513600d398ec4765df70c223424de7d40f577","observation_id":"43954f1a-3b41-4a44-9f14-a8a77bd48cb2","resolution":{"observed_at":"2026-08-06T20:02:09.555002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.236912Z","title":"Generalized federated learning via sharpness aware minimization","venue":null,"work_id":"c4de2952-19b0-4b34-9313-c6e5faa98d71","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.623551Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:98e2eef7bd7528700003d83096dbfce3192606b6cb9b7ce8f21d77c8b9b65b11","observation_id":"ed919782-3e66-4baf-8c90-b60cf3a35886","resolution":{"observed_at":"2026-08-06T20:02:12.239339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15963","last_updated":"2025-01-27T11:14:04Z","snapshot_observed_at":"2026-08-07T22:49:28.149295Z","submitted_at":"2025-01-27T11:14:04Z","title":"Evaluating Data Influence in Meta Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15963","snapshot_observed_at":"2026-08-06T20:02:09.747575Z","title":"Evaluating data influence in meta learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.747575Z"},"links":{"cited_paper":"/paper/2501.15963","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:fd5169c0a35c952852eb3931668a7582c8d6edcac210ed49b6c8c15ece8ab2b4","observation_id":"e2915214-8635-4745-a2d2-22d64b7f6400","resolution":{"observed_at":"2026-08-06T20:02:09.747575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:09.886322Z","title":"why should i trust you?","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.886322Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:789a1178611843ca692c93502c15938ef66d10803eacc6d9647748929b27724f","observation_id":"17fc5865-8db8-4e28-93fe-8ae8e04509c1","resolution":{"observed_at":"2026-08-06T20:02:09.886322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.226763Z","title":"Theoretical and practical perspectives on what influence functions do","venue":null,"work_id":"4254da6b-4990-40c0-a154-80498619f559","year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:09.990644Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:e1e13d489c0fcfcb03eb00601ba8b1464e956a6768d0851c3705fdb7bc248896","observation_id":"9fc2f2a3-af9a-4c62-abfc-026f96491c1a","resolution":{"observed_at":"2026-08-06T20:02:12.229121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.220455Z","title":"Adversarial training for free!Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"bc53b7f8-eb06-44ee-b0d7-33ca7d476cc8","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.171275Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:b0283b6134243d0e110690e58a35c29a0a7c9ecc1aa833f6237325d1242885fc","observation_id":"721fbaee-bad8-4e20-943c-e22ad8748832","resolution":{"observed_at":"2026-08-06T20:02:12.222955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.214215Z","title":"The ham10000 dataset, a large collection of multi-source dermatoscopic images of common pigmented skin lesions","venue":null,"work_id":"c8ff4389-e485-40c3-adc9-6b30c835e62a","year":2018},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.228922Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:409371ddc699f5e65d2c55a135881aa31e6e33f874ba34cd5d9d8c731f4aab51","observation_id":"47165dba-06c3-466e-99b7-c4d715a789d5","resolution":{"observed_at":"2026-08-06T20:02:12.216694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.207828Z","title":"Generalized linear models in non-interactive local differential privacy with public data","venue":null,"work_id":"8125250f-eb69-4ef5-bcf2-7f384fa8e64a","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.356695Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:c17dbc068da57aea4e5cf103164ae225496d05068819f3ec72066e60c546cdb8","observation_id":"05285cd3-6cbc-40e7-90d1-3d0552a30c3e","resolution":{"observed_at":"2026-08-06T20:02:12.210300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.201463Z","title":"Repairing without retraining: Avoiding disparate impact with counterfactual distributions","venue":null,"work_id":"481aba89-3139-44ec-bd70-ad4f45a5700d","year":2019},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.461231Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:92a9878afdf38ed3223e6e0d8792a35d7b056b7abb7a3df5af5270259e840d34","observation_id":"66b71c33-aabf-49a9-85bb-b2ef67ee97de","resolution":{"observed_at":"2026-08-06T20:02:12.203758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.195556Z","title":"The shapley value","venue":null,"work_id":"892378ae-7d43-4e28-ac69-dae4268c8595","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.608501Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:75a34c019ac8a9c9babf072ce4d8f152ef69c7b547ba65809f679bba993dd5ea","observation_id":"3d84cd81-af46-4ad4-a84a-4c08020ffc23","resolution":{"observed_at":"2026-08-06T20:02:12.197608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.189210Z","title":"R-drop: Regularized dropout for neural networks","venue":null,"work_id":"b927a0c9-3d97-4efe-8701-0c9812c401b9","year":2021},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.739362Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:86df0a33e60739f4693e8c906b310f2e2711b8b4233f55fbbf34904489efc759","observation_id":"657244ff-9a34-4c5e-a1ac-2d59459cfc60","resolution":{"observed_at":"2026-08-06T20:02:12.191502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-07T17:47:02.067367Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T20:02:10.809020Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.809020Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:346fce61238e61075ec70a839dc1cf5d55c024c51f920fa44daa9e6f0eab26f3","observation_id":"a4b53896-a980-4e21-bb80-20510d0c1b40","resolution":{"observed_at":"2026-08-06T20:02:10.809020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.182314Z","title":"Practical differentially private and byzantine-resilient federated learning","venue":null,"work_id":"6f6c5e83-e9e1-43b5-b648-03c7b3aa8da7","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.907131Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:765dba00b2617e583edc41365ac028e5d44665c16d4475f563cb7de23d1052d8","observation_id":"6df251cf-1d34-4c59-9346-e0368acd9c3c","resolution":{"observed_at":"2026-08-06T20:02:12.184835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.175227Z","title":"Preserving node-level privacy in graph neural networks","venue":null,"work_id":"3f4bde29-0856-494d-998b-4008eb4b8295","year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.995027Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:a8707fcf7cf966921c663f18d0184ea8adb4a7fc69f3dbe5685475b0cf2e33f1","observation_id":"e7fea94d-37fa-4b60-9602-0624c88221f3","resolution":{"observed_at":"2026-08-06T20:02:12.177589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.168375Z","title":"A theory to instruct differentially- private learning via clipping bias reduction","venue":null,"work_id":"59648026-0c48-48b0-b0ee-6d4a5a22bfd9","year":2023},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.107372Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:646be7b6fa0293677d44371ba243d520ecb934565aa83550adfedbeddd4e7396","observation_id":"c33fe4c2-35cc-498c-9347-6d9c8ac9facd","resolution":{"observed_at":"2026-08-06T20:02:12.171179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.161637Z","title":"Data valuation using reinforcement learning","venue":null,"work_id":"4771aaf5-9b75-4029-b282-f2cf88426bca","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.201437Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:37ddbd3cb9617ac9d81a79d0952dd4eaed2be07693418fc3ad3c68c7fee83cfb","observation_id":"41f6a1c1-2f34-4a1c-9492-c25a9112e118","resolution":{"observed_at":"2026-08-06T20:02:12.163900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.10941","last_updated":"2017-05-31T04:56:25Z","snapshot_observed_at":"2026-08-05T12:22:57.956907Z","submitted_at":"2017-05-31T04:56:25Z","title":"Spectral Norm Regularization for Improving the Generalizability of Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.10941","snapshot_observed_at":"2026-08-06T20:02:11.281313Z","title":"Spectral norm regularization for improving the generaliz- ability of deep learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.281313Z"},"links":{"cited_paper":"/paper/1705.10941","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:1c1726ed6add68028276849b0e58925f99bfc93b0160f85d2e2c6005eccb9c9d","observation_id":"fb3fd92f-db83-4b0a-a328-6c91a5a62089","resolution":{"observed_at":"2026-08-06T20:02:11.281313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17515","last_updated":"2025-02-22T14:57:28Z","snapshot_observed_at":"2026-08-07T17:56:23.145727Z","submitted_at":"2025-02-22T14:57:28Z","title":"Towards User-level Private Reinforcement Learning with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17515","snapshot_observed_at":"2026-08-06T20:02:11.411545Z","title":"Towards user-level private reinforcement learning with human feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.411545Z"},"links":{"cited_paper":"/paper/2502.17515","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:4db263281c8237d75e4e8e8a0595abe6afa3d037afc5b451880ac5929e04d6f3","observation_id":"63a5fe04-5eb8-410c-8678-0e7792f78026","resolution":{"observed_at":"2026-08-06T20:02:11.411545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09022","last_updated":"2025-02-14T05:46:53Z","snapshot_observed_at":"2026-08-07T22:50:48.219369Z","submitted_at":"2025-02-13T07:19:05Z","title":"Mechanistic Unveiling of Transformer Circuits: Self-Influence as a Key to Model Reasoning","version":2},"cited_work":{"arxiv_id":"2502.09022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.09022","snapshot_observed_at":"2026-08-06T20:02:11.896730Z","title":"Mechanistic Unveiling of Transformer Circuits: Self-Influence as a Key to Model Reasoning","venue":"cs.AI","work_id":"b1bf29c3-d149-47bf-8475-4cdd22aae598","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.474879Z"},"links":{"cited_paper":"/paper/2502.09022","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:2241812a04d9735846378f59f9170660f531426bd9f8b9294c7892e67d976470","observation_id":"3d07b06f-dd56-4116-8543-90e42b0b70d5","resolution":{"observed_at":"2026-08-06T20:02:11.960151Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.154910Z","title":"Improved rates of differentially private nonconvex-strongly-concave minimax optimization","venue":null,"work_id":"084ac562-9fa4-4b6d-8ffa-09cb7fa09f3a","year":2025},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.558279Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:5118bae660a73f6862aaede24fe7d05fb0f5dc50270588ee184b5e3a4d2d95dc","observation_id":"6a8a13c6-2915-4d41-b5b9-e3118f6df2bd","resolution":{"observed_at":"2026-08-06T20:02:12.157570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:02:12.147982Z","title":"Penalizing gradient norm for efficiently improving generalization in deep learning","venue":null,"work_id":"c5330061-f765-44c4-8816-8407e18aad03","year":2022},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.563707Z"},"links":{"citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:801360a5e9353baed745e496950373fcdfb6a74e0ad93560b70e6f30f389ed75","observation_id":"c291337a-4a4d-442e-acf3-0dd049b536de","resolution":{"observed_at":"2026-08-06T20:02:12.150675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07347","last_updated":"2020-06-07T18:39:33Z","snapshot_observed_at":"2026-08-07T22:51:12.935770Z","submitted_at":"2020-05-15T03:54:53Z","title":"Towards Assessment of Randomized Smoothing Mechanisms for Certifying Adversarial Robustness","version":3},"cited_work":{"arxiv_id":"2005.07347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.07347","snapshot_observed_at":"2026-08-06T20:02:11.750553Z","title":"Towards Assessment of Randomized Smoothing Mechanisms for Certifying Adversarial Robustness","venue":"cs.LG","work_id":"6307f4a5-0484-492c-936a-06aeab737134","year":2020},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:11.666342Z"},"links":{"cited_paper":"/paper/2005.07347","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:65b10f4dc136dd5afaa9048ccb8cb4d208e1a174488b72c52acd0112374a7cd2","observation_id":"ed97e6a5-ff57-4d96-b752-47c17672bc2a","resolution":{"observed_at":"2026-08-06T20:02:11.810878Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:31:08.588633Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":38},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 1 inbound Pith citation observation for arXiv:2507.04059."}