{"as_of":"2026-08-13T19:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21e6736e3daa9a5b999d68bdc7f9c3b3499f4a98eb7eae44dc4227b18a158ad2","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T09:09:29.470093Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:54:47.781434Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10803","snapshot_observed_at":"2026-08-02T07:54:47.781434Z","title":"arXiv preprint arXiv:2607.10803 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09800","last_updated":"2026-07-28T02:32:08Z","snapshot_observed_at":"2026-08-08T04:58:48.026355Z","submitted_at":"2026-07-09T15:23:42Z","title":"Reference Traces for Auditing Invisible Weight Updates and Guiding Exact-Budget Protection","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-02T07:54:47.781434Z"},"links":{"cited_paper":"/paper/2607.10803","citing_paper":"/paper/2607.09800"},"observation_digest":"sha256:b9ed77f069e1682dd2ff5f046f19bb6f0a8c38f5abd29d00a9b85080b3350b0b","observation_id":"d69bab3d-e5ee-4fe5-9909-76139a27b499","resolution":{"observed_at":"2026-08-02T07:54:47.781434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.10803/citation-record","integrity":"/paper/2607.10803/integrity","json":"/paper/2607.10803/citation-record.json","paper":"/paper/2607.10803"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Memory Aware Synapses: Learning What (not) to Forget","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:3480425d4e6b8985324a5d1e321f8f7416b6e2c0550e96963b975d3602d0f5ed","observation_id":"acbff4c0-f61e-45bd-8141-9a8ae7ec292a","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Systematic Outliers in Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:a09075f3908b2c630e91d8ffb213835b4e62bf4c3f6edfdd9785868ada7ec127","observation_id":"937190fa-5f95-4310-913a-cd7e648a6429","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"LayerIF: Estimating Layer Quality for Large Language Models using Influence Functions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:d4e8b9d4d6f36f4114c9c59caf2c406c3d4f329011d2785be82ce2e07b0e4531","observation_id":"1427567c-07df-4445-bf22-1ef01d7b17dd","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-12T08:59:05.030983Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:135f0886e3a825626ba37a5def110c30fb7f0f85fc903183d8f38629822589fd","observation_id":"cd290a39-4b23-4974-acea-41660138cd5f","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23276","last_updated":"2026-06-24T01:41:10Z","snapshot_observed_at":"2026-08-13T18:49:43.934849Z","submitted_at":"2026-06-22T12:53:54Z","title":"Exposing the Illusion of Erasure in Knowledge Editing for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.23276","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Exposing the Illusion of Erasure in Knowledge Editing for LLMs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2606.23276","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:119d6bbc51bebf70a3114535f981ebc18943825d1f6f69b198fd1690243d92ac","observation_id":"0c371f5f-9e12-4294-9cb3-3e04ba5f8c50","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared Kaplan, Prafulla Dhariwal, Arvind Neelakantan, Pranav Shyam, Girish Sastry, Amanda Askell, et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:fa4be5ac614c6e94e1b47bb2aa250efd4d50664f5caf63e742da65141144d43a","observation_id":"e84134f6-beae-42e4-868e-d2f00547f4a8","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Evaluating Large Language Models Trained on Code.arXiv preprint arXiv:2107.03374, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:e2b417100e63c1c7555ab3ac72a01feed52997939de45ba8176fa8197a1d4e2d","observation_id":"71e9ce2b-d8fc-491a-af0d-9bad6243e772","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Outlier Gradient Analysis: Efficiently Identifying Detrimental Training Samples for Deep Learning Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:f619743c615e7aa3786300e756c9b8528166a9f9e9a55a03bc3423797fbe35d8","observation_id":"79cd675a-0068-45a0-811f-3a5d4c27d548","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Training Verifiers to Solve Math Word Problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:2ce472689797d9631324076e701283926bac08231c637b3c377f9d6ed93327e5","observation_id":"a5f8dc71-1fdd-4e75-9c26-aa491adeee6c","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Evaluating the Ripple Effects of Knowledge Editing in Language Models.Transactions of the Association for Computational Linguistics, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:e3c27c8489dbedb84bb5c78d287c7d47ce65dd718eb76c05173450be90bb653e","observation_id":"252e2b41-cd3d-4333-a40b-2b6f525b233d","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04902","last_updated":"2024-04-08T22:42:49Z","snapshot_observed_at":"2026-08-13T05:29:38.493782Z","submitted_at":"2023-11-08T18:59:54Z","title":"Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04902","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models.arXiv preprint arXiv:2311.04902, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2311.04902","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:0f28898519cfe44ec5927f956c65625621bd6e7ba99d96829f7a5d2e890f93df","observation_id":"eb370e07-eb6e-4fbb-b140-635260e71c46","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.20207","last_updated":"2026-05-14T19:27:02Z","snapshot_observed_at":"2026-08-03T22:04:29.443348Z","submitted_at":"2026-02-22T22:55:11Z","title":"Golden Layers and Where to Find Them: Improved Knowledge Editing for Large Language Models Via Layer Gradient Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.20207","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Golden Layers and Where to Find Them: Improved Knowledge Editing for Large Language Models via Layer Gradient Analysis.arXiv preprint arXiv:2602.20207, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2602.20207","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:23c8d84ee78e742cf91705d14c716ad67dac1ac759330fc75b3d4af7e7a56e5b","observation_id":"cbd8cb77-bd5f-4b3e-b5fa-ecc3cd2ccbd3","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Sharp Minima Can Generalize For Deep Nets","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:ad9fd48514ac6f2391bd5054baf62467f107f9b3d8823d4076af7b16024d26d4","observation_id":"d622269a-8ac5-4048-a131-06684e64518a","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Dolan and Chris Brockett","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:f82ed56ed4312811fc021d2af0d010ba200ad75ef230c7ba99b9e46fbb8017b7","observation_id":"930413c4-f1cc-444c-a355-e2e7bf8516a7","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00208","last_updated":"2024-10-13T21:05:31Z","snapshot_observed_at":"2026-08-13T00:18:01.011627Z","submitted_at":"2024-04-30T21:20:17Z","title":"A Primer on the Inner Workings of Transformer-based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00208","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"A Primer on the Inner Workings of Transformer-based Language Models.arXiv preprint arXiv:2405.00208, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2405.00208","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:11257bccaadfbb2021d79d6c32b142264e7aef5fb4c9cc7b87f030b344725af2","observation_id":"b8170ba8-a3cf-4660-ae68-63ce9d7b66b4","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Sharpness-Aware Minimization for Efficiently Improving Generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:178612275055d3b4896bd29f1c3f838c4569bafdbb31c358088beb6c400fef7e","observation_id":"ac3bcfe5-4192-4de7-b603-0f4c67207ddd","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pretrained Transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:4abda6cf5dc1ddde32e23220f58349a10eaf1e560df4dda373c06166b89a1268","observation_id":"4a7b82fc-0aaa-416a-a82b-52a17c39baba","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-06T16:38:23.884750Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"The State of Sparsity in Deep Neural Networks.arXiv preprint arXiv:1902.09574, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:e2867ee788f9f9c272f943abb7f6f0b6f90097058376d23070924feb34bfe3b4","observation_id":"a1d96ac6-3ecc-4878-ae7c-46e5d24722a8","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:bc93b57ed86f5e9fc87385f00921b3333f54049d96bde5b96224a6e90b5aefd1","observation_id":"1c924bf0-e685-4409-99c3-6b889108c494","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"The Language Model Evaluation Harness, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:ba358ce67fd70d88da76c870ac504560564406b4e3c196585153cce94d5f2fbf","observation_id":"2e0edd43-9172-4bdf-9a35-44ac8b8ef3c0","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Defying Catastrophic Forgetting via Influence Function.Artificial Intelligence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:52bc5c4fe7611b77a7fa8a155f92347dfd9c08a88a28a64e8ff28201ba7b57b2","observation_id":"0738d2cc-5c7d-49a6-983f-ea5dc5c26e96","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"OLMES: A Standard for Language Model Evaluations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:54d097f9715a249ad6bbf2be4136f2c066155f833b8763a44c35f9b5681ceb6a","observation_id":"b71cfe44-5cd6-4e50-96ee-4c8db55df961","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Rebuilding ROME: Resolving Model Collapse during Sequential Model Editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:c753a73e7cebef28191e6454f85ade5ce916ce1a42542fe46624e7b0ff941246","observation_id":"b631f53b-9efa-44dd-b28d-58e3a35a5d63","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Learning both Weights and Connections for Efficient Neural Networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:697a4873e199688e579055193c58f51ac122af1edca5e9be7c5da18fd3b5b5aa","observation_id":"5380c239-e041-4428-8ec0-7374f44ed928","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:e0896dc849aa832d8b8d04e98fba50ae139c27ab69eb3aa366824eabb8d0595b","observation_id":"d3678281-ca44-4cdf-9388-4f7f0198ae5f","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Aging with Grace: Lifelong Model Editing with Discrete K-Value Adaptors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:edd78284f4624ac4ddf3b5dedd528a9fc1b0f36c3037b438ded687389ed2d05b","observation_id":"97ef87ea-8b52-4af4-b60b-e0f55530affc","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:396c6b16c7870b6cd42fce4bebbcc2dc22e1e18861d078fda61c4f2bbb0e0b67","observation_id":"7aedce6b-2d06-4de8-b13f-a5fb1aef84ca","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Training Compute-Optimal Large Language Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:0ceb42aa12a09484b3d3c1f89f5e76eef4d8ff0aa98ba57be36bbe4eb6b01ca1","observation_id":"196f2282-f878-4d92-9826-a24bad7365d1","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"SliM-LLM: Salience-driven mixed-precision quantization for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:eeb8b5b9c98380d651626cf225b2dcbaf6c60f5b6fa6256b16019135556de4df","observation_id":"50116817-4fae-4b81-bce6-6c4fd2a6e894","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Scaling Laws for Neural Language Models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:c4d85eb995a5e7d43bd65f64f3e3f5cf970c204fff5f12a18d58ae8086c0ab9f","observation_id":"d4afbe4e-b649-43dc-8974-94d876ad3061","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Overcoming Catastrophic Forgetting in Neural Networks.Proceedings of the National Academy of Sciences, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:37ab87997db5721c2bc6fd42786521c9287fd8d72a007af5e9761a8dfb9b8f1a","observation_id":"ef36aa31-3510-4b98-ba60-4ddfee6cd1c3","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Denker, and Sara A","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:bf6f9a0cc032fc67e9853ac15e25eb94f962855ad3146339c71ebb83dfe16bfa","observation_id":"eade333b-9249-4147-b478-747ce9100b86","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:2354991a939c7e052e3961c6f24fb00a5bc0dcabff2690cfde68d3a3e3d49704","observation_id":"26a3fa4f-8a09-46f5-b37b-35ed0f389431","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Zero-Shot Relation Extraction via Reading Comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:c188e10f1fbdfd033ff7655844c5d54b01ce2b66c357e000a06c9a5cf1ad578f","observation_id":"be4623e2-8e84-4947-b205-793fb71aafb5","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Continual Learning and Private Unlearning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:43cb194e85e0d87907d1ab260978be758c30bd655679293a768b9fedaab4057a","observation_id":"b81cb7db-62ec-4657-a099-0a5bb21833f0","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Is Your Code Generated by ChatGPT Really Correct? Rigorous Evaluation of Large Language Models for Code Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:fc9a98bda20792ce8fecb6560c223b7671196e59fdcb00da34e08a3ae129e960","observation_id":"024dff74-4e16-4540-ba45-76caab260444","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Mahoney, and Yaoqing Yang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:fe2dbe0149cf2594598b3ccb6f56f842979414572269183c018b92f12e4b2b4e","observation_id":"b5d9a914-f2c7-411a-885f-654eba36eb71","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Learn to Explain: Multimodal Reasoning via Thought Chains for Science Question Answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:7c3793b67fd2d60b937fda785c338ff851f14a26d820aae47808009f168b22c0","observation_id":"e693639c-0aee-4f2e-8534-26c2a243b526","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Zico Kolter","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:085adc9a01aac0bd9b90eb447371615b07336b456cd1687cfdd010713d715295","observation_id":"ad451a59-0f68-4216-a082-4286ceba4f05","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Locating and Editing Factual Associations in GPT","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:bbb456fc749534ed165cc89fec1bfcfcb3691fd11f7724b06c3ac636256e0f7b","observation_id":"1c02d38b-3390-45dd-b8bf-26a37fece954","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Large Language Models: A Survey.arXiv preprint arXiv:2402.06196, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:b582656463bcbe46ff05e6cb40c0b67d9dfdc20b05c38a547b2c251b82267d43","observation_id":"600408dc-0802-4a60-be87-3076035fd086","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Pruning Convolutional Neural Networks for Resource Efficient Inference","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:4287879b81cb8beb76f03add203510e082672ba70e8136a37a2a51bb5c1d7a28","observation_id":"7fadac09-1258-4ba5-ad46-703f312f547e","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25098","last_updated":"2026-05-28T00:10:24Z","snapshot_observed_at":"2026-08-10T23:10:49.292087Z","submitted_at":"2026-04-28T01:04:09Z","title":"Revisiting the Effectiveness of LLM Pruning for Test-Time Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25098","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Revisiting the Effectiveness of LLM Pruning for Test-Time Scaling.arXiv preprint arXiv:2604.25098, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2604.25098","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:c494fa3e78e96aee26cb99313c9603bfe0df25893ed51b77e59187715f7200eb","observation_id":"b07c52f8-abb8-471b-ab1e-44728ab1e25a","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"GPT-4 Technical Report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:53f1590d5160711922ba4ce6b010298f6ed12f48a533fd5311d82c004a03a39b","observation_id":"ee002291-73f3-4dcb-865e-bc549d59d9fa","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"AlphaLoRA: Assigning LoRA Experts Based on Layer Training Quality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:aaddc4903b055adf46def8463873add7455dc83848877ce5532883fcd9562125","observation_id":"e1119230-e1f2-43be-a94a-05b9a980f4fe","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"How Many Parameters Does Your Task Really Need? Task Specific Pruning with LLM-Sieve.arXiv preprint arXiv:2505.18350, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:cd07b9bbe4ad95d104f12ba478b1ff36c94fffd14463c654ecec1721255daa19","observation_id":"ba7d629d-937a-4fa4-ac80-c569bd5bff51","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"PB-LLM: Partially binarized large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:376caecc531670e1be0fbfa9ca661d32021acecb71912028fb74c53df139db12","observation_id":"9cba4075-eed7-4f01-b5bf-731fa440d9ba","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07271","last_updated":"2026-05-08T05:35:32Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T05:35:32Z","title":"Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07271","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Understanding Performance Collapse in Layer- Pruned Large Language Models via Decision Representation Transitions.arXiv preprint arXiv:2605.07271, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2605.07271","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:ccecb2c77ab6a4d1030c9c51b4f5f87d4cd89b32473009bfbcc5b88401258e72","observation_id":"c6a3e49b-c22d-45c6-8fbf-fa11eef1c80c","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17493","last_updated":"2024-04-14T05:20:10Z","snapshot_observed_at":"2026-08-05T16:03:40.517679Z","submitted_at":"2023-05-27T15:10:41Z","title":"The Curse of Recursion: Training on Generated Data Makes Models Forget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17493","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"The Curse of Recursion: Training on Generated Data Makes Models Forget.arXiv preprint arXiv:2305.17493, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2305.17493","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:063f23429be39ce328c185d6a2336b053cefbfc68cee5fef0780a3d4d3168a00","observation_id":"29b67a78-bf47-417d-8102-85d3dbb4ede8","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Zico Kolter","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:be6865a0c11cd054a8e472b6149674f20d9e2c4986fbb2bd1b6ac1195bf718ae","observation_id":"16a5bc28-4057-43b6-a5c0-2d4cd7ab1015","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Optimal Brain Apoptosis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:0906e20fb249aeaa26c8a5129c6bfbe58f885096f7873081073191c935f4a4a7","observation_id":"7d8a29d5-d406-431f-8ef6-470666ae5ecf","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Gemma 3 Technical Report.arXiv preprint arXiv:2503.19786, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:6bffd3edc79895f72ac53ef36620a68a9bfeba9a35ffa92565597391dec4c096","observation_id":"392d3533-5598-42cf-be26-f21a7c8065be","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"LLaMA: Open and Efficient Foundation Language Models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:7408fce13c730fdad2535bdbae9c70736edc6d97428124c53ab472d0eb12d20e","observation_id":"76995ef8-2f68-44be-8ec1-cf610335c67f","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"First is Not Really Better Than Last: Evaluating Layer Choice and Aggregation Strategies in Language Model Data Influence Estimation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:09ee701c60cb6c9108990911e82c251dfa1d727c0330c571d2c6e3bc11bcad26","observation_id":"10c46f2f-e68e-4c7f-85cb-2b6e1995b8fd","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:514971c9515c80f41c968e1ff85c0a9742e429737858fceb5816ea2e2a99afc1","observation_id":"8e95365c-4dd8-41b5-8aa5-bb6895b37487","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Why Language Models Collapse when Trained on Recursively Generated Text.arXiv preprint arXiv:2412, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:d7c905d23f3116779f0fe800b07c0f6d79e3822844f44ab44e4e93a95dae1bf9","observation_id":"c78896ad-c058-429b-8b38-12f18b0a66da","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"EasyEdit: An Easy-to-Use Knowledge Editing Framework for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:63fb6f8ecadfceca428c636f6df7d20ac21c0f074943d22588750e1dddd75967","observation_id":"26f310bf-5224-47a1-93d6-ca022cef8166","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Qwen3 Technical Report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:a9fbde75968bae8bfe3ab96c3b4a82b8ccb5e1727f6ccad42a441f6bd862fc1c","observation_id":"ff225daf-f6d0-48b1-a266-1af6e4bf2b09","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Kübler, Rupak Vignesh Swaminathan, Athanasios Mouchtaris, Sravan Babu Bodapati, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:ea0d4aaf439e3ac658f96236f8dc616d55530ec9f97bfc61094ac05a917f6c04","observation_id":"c2c408f8-f367-453b-9b08-9f4ed3d0e657","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Editing Large Language Models: Problems, Methods, and Opportunities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:1ee4b88d66ac403c17e17eec11d999e00c000205b7230fe8c145c7912880984c","observation_id":"f1154b6f-946d-488a-93be-17cbceb4ff80","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:7019d5328e46a55b72aaa6f2989243390b0b4d5ca5622a9b6ecd57c3ea483557","observation_id":"2aaa2076-b158-4ec2-8df1-1f917c5d4554","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Continual Learning Through Synaptic Intelligence","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:7b77112f27d07b3adc049b78110cf0441dfa8d85c5328e830a7c6833b7ef09c4","observation_id":"df09822d-f87f-4087-9165-2454837673a1","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"Boosting Large Language Models with Mask Fine-Tuning.arXiv preprint arXiv:2503.22764, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:7942c0a18e9793336d22308fe7fb6e0da3f53e960ba51ef1b2b1bca06110836d","observation_id":"c05dccb6-4bfb-400d-9d01-6eca85b0a92d","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01286","last_updated":"2024-11-17T06:50:44Z","snapshot_observed_at":"2026-08-13T04:50:01.828919Z","submitted_at":"2024-01-02T16:54:58Z","title":"A Comprehensive Study of Knowledge Editing for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01286","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"A Comprehensive Study of Knowledge Editing for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/2401.01286","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:f535e529ba736b1b3d3b058624d1b758abf7a946501b5ef9ded688a70d3b2e47","observation_id":"e68f0f5a-3aba-4b30-95c1-39f855fc7ba4","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"SparseSwaps: Tractable LLM Pruning Mask Refinement at Scale.arXiv preprint arXiv:2512.10922, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:feb7d06316c1ed476d98f4cf4f427995b939f2c94311f62c8f6233124390b623","observation_id":"a1644d03-58e1-4e80-bf75-d5b30cd052ca","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:936390ba52405d8de5433b741cfe7df8dfcfea863ed42623a0a52d79ad9b485f","observation_id":"e610d93c-4d6f-4776-b6bf-69e1100cb007","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T02:42:17.507209Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":66,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 1 inbound Pith citation observation for arXiv:2607.10803."}