{"as_of":"2026-08-10T17:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1bc69f8ba261e8d78e8643ea000ddbf8bf2e584bd208ca6a582625875b66cfc","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T04:26:13.390232Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.10777/citation-record","integrity":"/paper/2605.10777/integrity","json":"/paper/2605.10777/citation-record.json","paper":"/paper/2605.10777"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0665.364036","doi":"10.1145/3620665.3640360","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyTorch 2: Faster Machine Learning Through Dynamic Python Bytecode Transforma- tion and Graph Compilation","venue":null,"work_id":"abd261ad-4aca-4ea3-8090-344914daba35","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:64c20f6ac98e67c0bdb124b46956949013dc0750056800bcb9d5eca5c6791f76","observation_id":"1146a942-e9e3-45b8-ac95-2ba6c4707be4","resolution":{"observed_at":"2026-05-12T04:26:19.750035Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rezero is all you need: Fast convergence at large depth","venue":null,"work_id":"29f08e18-c4c0-41c2-b888-c3e9d4e12333","year":2021},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:43f95bd3eaaef17236330a28a165e894a1fd384d660bb3bd07f993364ec1f56c","observation_id":"4a5cb2d8-04d3-441a-8c79-049b349aec06","resolution":{"observed_at":"2026-05-12T15:06:39.111699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Considerations for governing open foundation models","venue":null,"work_id":"007a8d19-7e6b-415b-b038-7cf7ef80de06","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:46029774bfcdd7ffecbe776c8ad6fab9906cf85e45e4e51d7f97ba1c87ce61f4","observation_id":"74e24c33-00d4-4b14-9b9a-8aff0953f4ea","resolution":{"observed_at":"2026-05-12T15:06:39.205357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convex optimization","venue":null,"work_id":"cbe42ac3-19b3-49e0-bbda-d9d96a98248a","year":2004},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:0fdfebfce97a193db818714b3357b53a035ff79444989ad868251f2344c52c07","observation_id":"edafb6cf-e459-4b8c-be2d-4bdf07ced4c7","resolution":{"observed_at":"2026-05-12T15:06:39.108414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08606","last_updated":"2025-07-25T16:55:43Z","snapshot_observed_at":"2026-08-08T04:26:43.927211Z","submitted_at":"2025-02-12T17:52:47Z","title":"Distillation Scaling Laws","version":2},"cited_work":{"arxiv_id":"2502.08606","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.08606","snapshot_observed_at":"2026-07-10T10:27:02.464784Z","title":"arXiv preprint arXiv:2502.08606 , year=","venue":"cs.LG","work_id":"a58622e0-207e-45e8-ae59-ce47bcd7c1a8","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2502.08606","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:f889ae01e47ee68bf59a184f8dc55dc1ae9c4950e6c021563555bcecb68cc2f9","observation_id":"7abbae8a-218a-41bf-bba6-22ca9e906757","resolution":{"observed_at":"2026-05-12T06:16:28.199224Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open technical problems in open-weight AI model risk management","venue":null,"work_id":"a9fda300-e71d-47f2-bde8-f01055ab72e3","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:e0edd5b430e189d019584ba6504d7c49b693ee2b9462d44191c12fdd7de0f5d7","observation_id":"08bc4166-72ed-4fe7-93dd-ad84d01dcdd5","resolution":{"observed_at":"2026-05-12T15:06:39.115184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06174","last_updated":"2016-04-22T19:21:36Z","snapshot_observed_at":"2026-08-08T09:03:25.135475Z","submitted_at":"2016-04-21T04:15:27Z","title":"Training Deep Nets with Sublinear Memory Cost","version":2},"cited_work":{"arxiv_id":"1604.06174","doi":"10.48550/arxiv.1604.06174","metadata_source":"pith","pith_arxiv_id":"1604.06174","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Deep Nets with Sublinear Memory Cost","venue":"cs.LG","work_id":"f2c5c287-a500-40e4-a136-e7e3172db1d7","year":2016},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/1604.06174","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:e89aa94c781060e4e0734600e76b1eb2a54eaa1fb99d7d5434bc1fa4c1a5bab2","observation_id":"1c8bfe88-8faa-44d2-bfb3-851ae2253786","resolution":{"observed_at":"2026-05-12T06:16:28.211982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T12:26:33.666045+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05688","last_updated":"2026-04-07T10:40:16Z","snapshot_observed_at":"2026-07-06T22:54:21.571606Z","submitted_at":"2026-04-07T10:40:16Z","title":"Attention Editing: A Versatile Framework for Cross-Architecture Attention Conversion","version":1},"cited_work":{"arxiv_id":"2604.05688","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05688","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention Editing: A Versatile Framework for Cross-Architecture Attention Conversion","venue":"cs.CL","work_id":"3da7dcf6-13e1-4cac-b200-a71fa577e803","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2604.05688","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:5ed872583b4a68cfffd89906f2bf5e3fb220a20f7a7c14a73e361a2014bf9961","observation_id":"bcb8e05c-6c3a-42a8-ad10-b21a967a7e5f","resolution":{"observed_at":"2026-05-12T06:16:28.159412Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"bfeb1036-7737-44be-b663-3e3b85731b0f","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:646c107dae3e148605ba53e3cf5f3151ff0d0cb86062b8b7be80ed24dc171837","observation_id":"1662ecce-cdd5-485a-a644-ef0746cef39b","resolution":{"observed_at":"2026-05-12T15:06:39.177388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sigmoid-weighted linear units for neural network function approximation in reinforcement learning","venue":null,"work_id":"fe44ba34-e0cc-469a-821d-d4ade7a2dd8e","year":2018},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:b52e89f06bc1f23993f9a74f2ade5b4bc38d879ea2809a6c7c00d520a6718958","observation_id":"17d561dc-8334-4753-a7d1-c0c5aac3ebac","resolution":{"observed_at":"2026-05-12T15:06:39.208526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards LLM unlearning resilient to relearning attacks: A sharpness-aware minimization perspective and beyond","venue":null,"work_id":"7e94c7bd-ea32-40aa-99ba-8c53a2b3eb19","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:6b7bb0676088288959106580a01677206ae780c3057005c87eab74f43acd3831","observation_id":"c907fbc3-a09d-4d07-936a-f324b5030233","resolution":{"observed_at":"2026-05-12T15:06:39.098223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1025683","doi":"10.5281/zenodo.10256836.url:https://zenodo.org/records/10256836","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Ariel Gera, Odellia Boni, Yotam Perlitz, Roy Bar-Haim, Lilach Eden, and Asaf Yehudai","venue":null,"work_id":"1a8adc3d-c761-4a48-acc1-c04d569c2d4a","year":2023},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:cb710f20a80c66b353e2583e74ca01d9628369427ddd2ac5bf477342468532fb","observation_id":"3558afd1-82ac-4e6f-b93e-568da0125eae","resolution":{"observed_at":"2026-05-12T06:16:28.190212Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the symmetries of deep learning models and their internal representations","venue":null,"work_id":"4490bed8-7939-401d-b3fc-5a18abc30dff","year":2022},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:1707bf89ecbddadf58c2d5788014461422a0febc05f4a807c4aa6cddcdac13a0","observation_id":"e3c25075-141d-4d56-9823-40fce105a36d","resolution":{"observed_at":"2026-05-12T15:06:39.090827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:e50981d19fd087417e0adcb1abf29a4b703899115b83bffa693d135f6cba4171","observation_id":"32b4c2a5-2955-488b-8e91-4ccdf4033bd0","resolution":{"observed_at":"2026-05-12T06:16:28.204900Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating derivatives: principles and techniques of algorithmic differentiation","venue":null,"work_id":"c0461c76-ad1e-4d4e-b9d4-1ef06a61817c","year":2008},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:eadfb8c97a747a4dd97b76c63d44995eba7f9465534dcbd43bbb8d24ed5f268f","observation_id":"036b333f-8477-44d5-893a-35ca6dd68bde","resolution":{"observed_at":"2026-05-12T15:06:39.187572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:ed700d246f7f88e080d525f06bcd8fd073decf68973b1cd6117e0624b7357184","observation_id":"10df6a98-4eee-44ad-9c44-c5ea99d7bd46","resolution":{"observed_at":"2026-05-12T06:16:28.182058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lo RA : Low-rank adaptation of large language models","venue":null,"work_id":"ba7d9a6a-a3a8-4c35-baa9-8e035bad7577","year":2022},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:a3e7b6255bd3d353adc7258a02885566dc4ffeaab2825b68e080b983fa5f0406","observation_id":"ab32ee82-f0c0-4bf8-adda-080e6747aff8","resolution":{"observed_at":"2026-05-12T15:06:39.063760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unlearning or obfuscating? jogging the memory of unlearned LLM s via benign relearning","venue":null,"work_id":"dc081e01-417b-4f94-b147-072ed07f678d","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:acd4b7d6f7880642299abd708ca90d3814efd58a7ab2a3b1b346d69bf2dc5e58","observation_id":"9d23481f-d0f2-4b60-85ee-cf6803769191","resolution":{"observed_at":"2026-05-12T15:06:39.101413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vaccine: Perturbation-aware alignment for large language models against harmful fine-tuning attack","venue":null,"work_id":"f056ed6a-4f4c-4c93-96a7-d660c814dc07","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:b8035b4dc31c7e3c4c48008ab513a689dc52b0c948f68f39cb85198ab6d83a2e","observation_id":"52e29308-b72e-4f3a-b007-bfea6bcd1d7d","resolution":{"observed_at":"2026-05-12T15:06:39.086812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Booster: Tackling harmful fine-tuning for large language models via attenuating harmful perturbation","venue":null,"work_id":"06938a72-7129-4983-a270-bf1c556cb13d","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:36b8134a926510446a08ae5d9f26f99b03bf8b83caa7b4b604b651cc4fb181b7","observation_id":"817a1468-5c41-4194-b5a6-a28c76e74035","resolution":{"observed_at":"2026-05-12T15:06:39.154570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/03610919008812866","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hutchinson","venue":"Communications in Statistics - Simulation and Computation","work_id":"eb2c02b3-49ce-4c35-8ce3-91babd7be55f","year":1989},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:32d8911a422c25841887f6fa642d628abb937e851c2f85348f17321b9d9e0aba","observation_id":"7b8976ec-21f3-4f33-a5e4-21bc2c052db8","resolution":{"observed_at":"2026-05-12T04:26:19.761188Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Disrupting model merging: A parameter-level defense without sacrificing accuracy","venue":null,"work_id":"7ab9e4b8-b34e-4e40-b6b2-59583254ae2e","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:23646b54524b1b9500f1eaaa39acf9ad0a538e10f1f5bc73e9f3403f7b9e5ba1","observation_id":"5baa2546-bafb-4ac4-99da-c92178d2684f","resolution":{"observed_at":"2026-05-12T15:06:39.119641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07918","last_updated":"2024-02-27T16:49:53Z","snapshot_observed_at":"2026-07-06T17:43:31.874919Z","submitted_at":"2024-02-27T16:49:53Z","title":"On the Societal Impact of Open Foundation Models","version":1},"cited_work":{"arxiv_id":"2403.07918","doi":"10.48550/arxiv.2403.07918","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.07918","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv.org","venue":"arXiv (Cornell University)","work_id":"5a70d0b7-4afd-4db7-9fbb-72efbf0cb9f8","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2403.07918","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:736843c5b885a15d2ea1013316edd2351bc69662a40a5ce8caae5797d6ea574d","observation_id":"19fef098-1275-4281-9259-800b95c4c31e","resolution":{"observed_at":"2026-05-12T06:16:28.174858Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"La cryptographie militaire","venue":null,"work_id":"fe607846-3095-4462-bc0c-858253f9adb3","year":null},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:1e53d3bd1b08f2c1d27788c3e454883bb1060e248527be32115d677e48c00dd8","observation_id":"12794b98-64b9-4fba-8bcb-54cb807868a2","resolution":{"observed_at":"2026-05-12T15:06:39.104885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mnist handwritten digit database","venue":null,"work_id":"02cc567b-c8fd-4004-b6f6-a221f9b2a95c","year":2010},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:7eab6017cb9b5140c8829ebbfbb0f5f1d52179622a9ec88a17c820a3f5433b23","observation_id":"d7a5f948-d4c9-49cf-a558-33d8ce3edbd6","resolution":{"observed_at":"2026-05-12T15:06:39.094475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lee, Addie Foote, Alex Infanger, Leni Shor, Harish K Kamath, Jacob Goldman-Wetzler, Bryce Woodworth, Alex Cloud, and Alexander Matt Turner","venue":null,"work_id":"23c39611-54cc-4fe0-a9a5-8adba1820da2","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:1b00e45d3fc83baac045da1816b5978b36d6ff56d26b4aef8af1d0db9a39961e","observation_id":"fd5c7b35-e46c-4543-b0a4-76fc5f5528f7","resolution":{"observed_at":"2026-05-12T15:06:39.183929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Module-wise adaptive distillation for multimodality foundation models","venue":null,"work_id":"b4532590-cd54-46b5-9781-ec29e70f203c","year":2023},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:e92bf46c077ba7ef092dc6b2df4d649e584215050fa2777c20c370d700c292e9","observation_id":"f0f564eb-d8b4-4221-bc04-9f6c048fc86d","resolution":{"observed_at":"2026-05-12T15:06:39.198609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Less is more: Task-aware layer-wise distillation for language model compression","venue":null,"work_id":"2629946a-c88e-420d-a80a-c0ffbd0ac7a2","year":2023},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:2a76a441c5480379ade0c6074170fb5b2079616169cdf225f81aeac0caab33ed","observation_id":"64b30074-c4ba-4ec9-95ee-04043a710959","resolution":{"observed_at":"2026-05-12T15:06:39.201757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Targeted vaccine: Safety alignment for large language models against harmful fine-tuning via layer-wise perturbation","venue":null,"work_id":"a837ecca-8f83-4188-97d2-42471da0e57c","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:3821cb72712aafcc1f298f4a4580080c687b6b1a9580eb94df24db06c977f231","observation_id":"cf9d5e9d-c275-4e6e-9457-5d6f8d3296dd","resolution":{"observed_at":"2026-05-12T15:06:39.191273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16918","last_updated":"2024-07-07T14:03:04Z","snapshot_observed_at":"2026-08-10T15:58:12.673733Z","submitted_at":"2024-02-26T04:47:32Z","title":"m2mKD: Module-to-Module Knowledge Distillation for Modular Transformers","version":3},"cited_work":{"arxiv_id":"2402.16918","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.16918","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"m2mkd: Module-to-module knowledge distillation for modular transformers","venue":null,"work_id":"6850008f-068f-4583-9ea2-7f99fa27e5db","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2402.16918","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:83d5f8c62ce89d3abd9cf3bf0aa4186307ce29972d2155ba2dbe78c2c7fad764","observation_id":"6438e206-5615-4d87-8bf8-bdd7e8b4453d","resolution":{"observed_at":"2026-05-12T06:16:28.220035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T23:11:31.663047Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"50e3fd03-0db4-424f-9dda-6def0ba0c26d","year":2019},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:8f2c46c00a207f3c3eb192c199ae47c0b108c60aaeb02932305dbca538703016","observation_id":"8aca8dd0-e0a0-4d17-9116-5a9d54493c2c","resolution":{"observed_at":"2026-05-12T15:06:39.137535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16835","last_updated":"2024-02-26T18:57:37Z","snapshot_observed_at":"2026-08-08T00:43:51.702314Z","submitted_at":"2024-02-26T18:57:37Z","title":"Eight Methods to Evaluate Robust Unlearning in LLMs","version":1},"cited_work":{"arxiv_id":"2402.16835","doi":"10.48550/arxiv.2402.16835","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.16835","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://openreview.net/forum?id= J5IRyTKZ9s","venue":"arXiv (Cornell University)","work_id":"b7a2e11e-fc7b-4101-95c3-aebe4ff4dabc","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2402.16835","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:383bb6da069ec28a5309a264cd10f1b606bbb032992f21c40a76a7e4c51236e9","observation_id":"224771bb-623b-4a19-b09b-7238f659527b","resolution":{"observed_at":"2026-05-12T06:16:28.240944Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T04:45:59.128873Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"e24e2207-094f-4683-b902-901f466712ba","year":2016},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:eb9b6979a7adedfe7045135828b79d1acd547872bdab87990ece2317994a756c","observation_id":"67b7680f-a3a2-4c65-a733-78a8c574347c","resolution":{"observed_at":"2026-05-12T15:06:39.148395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Antibody: Strengthening defense against harmful fine-tuning for large language models via attenuating harmful gradient influence","venue":null,"work_id":"d4390dfd-7f7b-4ec1-a09c-c2f26d758078","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:59dbe626e90edd4ee5b1a3639d08758b1a8d975d9216d973f56ebcbe45302049","observation_id":"ea66fccc-e7b5-48f4-9419-f1a9999126b5","resolution":{"observed_at":"2026-05-12T15:06:39.151782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On evaluating the durability of safeguards for open-weight LLM s","venue":null,"work_id":"a96bfcd6-de35-4144-b2dd-27554b394e2c","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:315c90658653905c04a22c773e799092a411a3fabc574882b80e2208d8acae7e","observation_id":"3e92ec92-0f11-46da-b1e7-295b1e156269","resolution":{"observed_at":"2026-05-12T15:06:39.141460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On-the-fly adaptive distillation of transformer to dual-state linear attention for long-context LLM serving","venue":null,"work_id":"542bbeec-bf86-4604-9214-7624406f1e1e","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:0706b22fd63250a0ff7fb0d295165178892d571c8f4408416c43b9cf4930eed5","observation_id":"06ccddfc-3491-472a-9113-488e9886a119","resolution":{"observed_at":"2026-05-12T15:06:39.170574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Representation noising: A defence mechanism against harmful finetuning","venue":null,"work_id":"6b7ce0cf-f754-4ee6-b32d-7f69c271320d","year":2024},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:c8c52d50f9187f1d59de0c82d66349e90692f81c9e2827a925df7118b161ed38","observation_id":"b096501d-cbfd-442a-b274-3bd087e188d6","resolution":{"observed_at":"2026-05-12T15:06:39.057592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Locking open weight models with spectral deformation","venue":null,"work_id":"b714e438-a015-4267-8c3c-d35310f6c788","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:b061ce8d03597d99332349a88714c7705f2bea79a89cd90e74311beb75a0b07a","observation_id":"6fa48836-8e29-45ac-b07d-e5ea1fbe5267","resolution":{"observed_at":"2026-05-12T15:06:39.048013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.18868","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Limits of convergence-rate control for open-weight safety","venue":null,"work_id":"cc771822-5bb1-41f3-9baf-4cb16c8d13ee","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:cda77ec855e9f17290ba583bdcab852382073883492891a094cf54d02f22bfcc","observation_id":"6ec0bf43-9976-4023-971a-671e7b05e4bc","resolution":{"observed_at":"2026-05-12T06:16:28.227937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:39a0221558728f9e34184be703397cbb87f936ef6820a0a8f7740c1d3c50ca66","observation_id":"5b971fa3-3348-4d8e-9740-352b7a29a59a","resolution":{"observed_at":"2026-05-12T06:16:28.233948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nemotron-cc: Transforming common crawl into a refined long-horizon pretraining dataset","venue":null,"work_id":"a3523152-9a46-4b10-8c8a-b5d8ccd644fa","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:9d2aeedfa2bf0e9d2484b1e6db3ac37efb2b615b2425c9998fe684dbdd813932","observation_id":"6a1bf5bc-f230-46fb-a202-fef2a15c569d","resolution":{"observed_at":"2026-05-12T15:06:39.194644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tamper-resistant safeguards for open-weight LLM s","venue":null,"work_id":"63bee8d4-11d0-42fd-bb41-805c7f885294","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:d5ad997986cc76a902d19ab7daac38968b481a80e8c79297f572c3dfc88553b9","observation_id":"e52b4358-e8af-4b05-be7b-c29abc9a7539","resolution":{"observed_at":"2026-05-12T15:06:39.166944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need","venue":null,"work_id":"9097e3f1-2892-4999-afad-052280788dad","year":2017},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:b28080890578beed98209dcfdf8e81cee3ba9ef0f0c71b60f24efa36a2fc2804","observation_id":"eeaf311c-e4d2-4ed8-94c1-c1fb5f3b9144","resolution":{"observed_at":"2026-05-12T15:06:39.174080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-destructive language models","venue":null,"work_id":"1ffb4115-d9f2-4ea3-988f-fa51ce27f55d","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:149bc647633e7c3f0048cae86e6f08adc38496dba87aaeef490871480b05e442","observation_id":"775eccb7-86f8-4244-a26e-a22d43c0aedb","resolution":{"observed_at":"2026-05-12T15:06:39.145128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.01548","last_updated":"2025-09-01T15:24:41Z","snapshot_observed_at":"2026-08-10T05:03:26.832639Z","submitted_at":"2025-09-01T15:24:41Z","title":"Model Unmerging: Making Your Models Unmergeable for Secure Model Sharing","version":1},"cited_work":{"arxiv_id":"2509.01548","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.01548","snapshot_observed_at":"2026-06-30T07:24:22.510046Z","title":"Wortsman, M., Ilharco, G., Yitzhak Gadre, S., Roelofs, R., Gontijo- Lopes, R., Morcos, A","venue":null,"work_id":"09ce60d7-f9dd-4d67-8beb-0fae37bd8022","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2509.01548","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:21d2b476ff31b80c9af8f467081ebb3002a6a6d978fa91ebbba456c9604c3b8a","observation_id":"73fd0f3e-ed64-4a4b-af11-c857908ace5e","resolution":{"observed_at":"2026-05-12T06:16:28.247059Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.00446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards building non-fine-tunable foundation models","venue":null,"work_id":"cff11b24-6f4a-40c8-9b6c-c3703eccceac","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:124afd924939f8f4d74a47caae9969d711067ad1716d6241ad7c179ff6209150","observation_id":"53ccb8b3-3a47-4ed8-b451-7a967801d77c","resolution":{"observed_at":"2026-05-12T06:16:28.255212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bert-of-theseus: Compressing bert by progressive module replacing","venue":null,"work_id":"f814fa31-b76f-4165-b3f4-33732618f3b0","year":2020},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:6db67aba89a2f4feb578729880dd8270d5860185a26061e6dac9e973591d102d","observation_id":"34d8b140-e1de-4225-92e7-a0a6ead138df","resolution":{"observed_at":"2026-05-12T15:06:39.158246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:7405d82672ce6987e78c0575c9bf991f7c4f19e29393f45d52621e608f52c794","observation_id":"ae51a38c-172b-4949-ac0e-0577a09820e4","resolution":{"observed_at":"2026-05-12T06:16:28.165173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Asft: Anchoring safety during llm fine-tuning within narrow safety basin","venue":null,"work_id":"433b7e8b-a0f6-409b-a757-e164bb567aee","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:cf8f9a6f6ce8da6a98a81362c9cdf563587ca7434a31b078231597dfef082814","observation_id":"a11eab7c-583f-4846-b6d5-67e096e72acd","resolution":{"observed_at":"2026-05-12T15:06:39.163682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Root mean square layer normalization","venue":null,"work_id":"ea2f745f-ccc1-40f8-9798-a4a96692a25b","year":2019},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:6b0592da7ff87b7bfcca4e78470e42395e21f7b8d60f482a002dcd0c7e36b647","observation_id":"c6909493-e337-4cd3-aab5-2a57efc76515","resolution":{"observed_at":"2026-05-12T15:06:39.180418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Symmetry in neural network parameter spaces","venue":null,"work_id":"7e11fd31-0a04-460e-9dd7-55f9776e1b28","year":2026},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:b4fbc3deda107e0c2ef429ed761da1856e463aab26ec2bb0efc40d6bef011341","observation_id":"36e56fea-88ca-483d-b611-75c1acb17003","resolution":{"observed_at":"2026-05-12T15:06:39.053925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding and enhancing safety mechanisms of LLM s via safety-specific neuron","venue":null,"work_id":"9e095868-d3e1-45fc-8057-e91804cdd9aa","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:802d0b5f71eced49a3d504efcd0012d84a35e9528a804762fe5b635f24e985dd","observation_id":"9904225a-f0bc-410a-9a31-3da0593dcb55","resolution":{"observed_at":"2026-05-12T15:06:39.060606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"14b46f1e-d2cd-41f6-a892-f1dcae2e5695","year":2025},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:342bf2315030d5ae506528895fe39c17c304559ccf58c008cef59bfe022e5239","observation_id":"62e517c7-d354-4fdf-ab4c-a9d0daac584b","resolution":{"observed_at":"2026-05-12T15:06:39.160723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Modular transformers: Compressing transformers into modularized layers for flexible efficient inference","venue":null,"work_id":"ec4c8989-82b7-4c31-a614-20920a6c00f5","year":2023},"citing_paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-12T04:26:13.390232Z"},"links":{"citing_paper":"/paper/2605.10777"},"observation_digest":"sha256:8c33e11f84116b733dda431b00c4254d689d725b0aa379d63945dc2e7c9f9d80","observation_id":"ff30451e-5da0-476b-b886-66b1eb42b9a7","resolution":{"observed_at":"2026-05-12T15:06:39.123334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.10777","last_updated":"2026-05-11T16:09:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T09:23:44.850357Z","submitted_at":"2026-05-11T16:09:32Z","title":"Locking Pretrained Weights via Deep Low-Rank Residual Distillation"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":1,"verified_exact":10,"verified_fuzzy":37},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2605.10777."}