{"as_of":"2026-08-08T04:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d45cef93784805c91fdf01190248059fb0e06e997018ad1e86a8d13c050fa6f","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:31:33.577852Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18799/citation-record","integrity":"/paper/2505.18799/integrity","json":"/paper/2505.18799/citation-record.json","paper":"/paper/2505.18799"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:31:27.593250Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.593250Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:6b16ece116cc9792ee4ffc0e5cbf1d16358b95dc1820f7ae5d171f6a0ccb8a3b","observation_id":"0e50ab0c-0b80-4588-baef-44904e02fd6c","resolution":{"observed_at":"2026-08-07T14:31:27.593250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-07T14:31:27.724255Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.724255Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:9bb6fd9418100b7985b36a346b54ae55ece8f26dcfd22bb15a60208110602bfe","observation_id":"109fe90c-179f-478a-aa74-12e82b054f5a","resolution":{"observed_at":"2026-08-07T14:31:27.724255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07875","last_updated":"2017-12-06T20:01:54Z","snapshot_observed_at":"2026-07-06T05:27:45.080675Z","submitted_at":"2017-01-26T21:10:29Z","title":"Wasserstein GAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07875","snapshot_observed_at":"2026-08-07T14:31:27.816937Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.816937Z"},"links":{"cited_paper":"/paper/1701.07875","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:263464d9811ec2f093b2f664c14b3c0dc6e5d49d04b60856f9975196cfb897b2","observation_id":"042da77b-9e69-40ed-a0b3-382a3e79f171","resolution":{"observed_at":"2026-08-07T14:31:27.816937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T14:31:27.926292Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:27.926292Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:6361185cac23e6ac3d41b4835ab064a4ad2f7dae2e2f651f186f317f5463efae","observation_id":"1d8d44ba-97b8-4dcd-91ab-526b961f2ad0","resolution":{"observed_at":"2026-08-07T14:31:27.926292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:28.030511Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.030511Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:781677646515794a71a137f7b24ad707e478ef239062ae31c7e00a5e387b9158","observation_id":"2234a53e-7826-48f6-84ec-326eeb92412c","resolution":{"observed_at":"2026-08-07T14:31:28.030511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:28.161330Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.161330Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:afbd9028cb3c06df3cee3c9c2c8909858b8554adfee43e0673591aac8f9a6e8f","observation_id":"67647a33-1061-4691-a854-eec3bdbe8e2c","resolution":{"observed_at":"2026-08-07T14:31:28.161330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09246","last_updated":"2023-05-16T07:52:57Z","snapshot_observed_at":"2026-08-05T06:19:25.316529Z","submitted_at":"2023-05-16T07:52:57Z","title":"Maybe Only 0.5% Data is Needed: A Preliminary Exploration of Low Training Data Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09246","snapshot_observed_at":"2026-08-07T14:31:28.279489Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.279489Z"},"links":{"cited_paper":"/paper/2305.09246","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:82a9e18509bfed6b25d3ec87b8ca4d6ee1fcd6f91df11a1bb28fd7ba231f5e5c","observation_id":"7fcd1e42-e9fc-4010-b60f-aae0e4afd8d4","resolution":{"observed_at":"2026-08-07T14:31:28.279489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:28.359608Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.359608Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:7cdae9fad60b11342956e618e032c90b1061ecb9d10e91868ddc255db9fc452b","observation_id":"ae75715b-0f87-44c2-81fa-72c6318ddf03","resolution":{"observed_at":"2026-08-07T14:31:28.359608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-07T14:31:28.500759Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.500759Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:203080be445bc727221534158e4aa6def7c483a067aa1a27fa6278fda5a35525","observation_id":"f03e2262-da91-4a08-9a8e-24f5a53f15f3","resolution":{"observed_at":"2026-08-07T14:31:28.500759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T14:31:28.592253Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.592253Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:352237808409fd4426e8ed519f5e9e67a49df5c81420bea078bb5e3b8622d0d4","observation_id":"cba8f17b-506f-4bac-a170-a40787f36ad1","resolution":{"observed_at":"2026-08-07T14:31:28.592253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04341","last_updated":"2019-06-11T01:31:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-06-11T01:31:41Z","title":"What Does BERT Look At? An Analysis of BERT's Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04341","snapshot_observed_at":"2026-08-07T14:31:28.707442Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.707442Z"},"links":{"cited_paper":"/paper/1906.04341","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:584afdf07e8c055c84b8c94cc315f338cd82142d02baa2de299561fd9d0b68f1","observation_id":"c54b2d7e-63c3-4baa-854b-fce7cc2415ca","resolution":{"observed_at":"2026-08-07T14:31:28.707442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T14:31:28.838061Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.838061Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:445b34ecaece7290cda3308576e40dcc93eead7a0dae3cfd85764e48d4b9d589","observation_id":"e0931648-5682-4c23-a24c-86307ee0da96","resolution":{"observed_at":"2026-08-07T14:31:28.838061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:31:28.924946Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:28.924946Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:73d2efca9af0b3eac5d84075a54833cb72db5ac70dfb9332cd4e13d17c16b08b","observation_id":"60c08b52-5e69-4346-a441-45df0e39f1e5","resolution":{"observed_at":"2026-08-07T14:31:28.924946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-07T14:31:29.022900Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.022900Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:ab02427a1e43bff77ef208f935875ce44df9ddc177785eca7e61a702f2f1ddea","observation_id":"4de72ca9-7fec-4e40-881c-8c20eb00bf67","resolution":{"observed_at":"2026-08-07T14:31:29.022900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:29.145234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.145234Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:43882e45bcd92b02e5c5ad95fc953de4d4bd6304ebd77059f3c52a6c8e410db0","observation_id":"a2f1bbd3-8407-4215-ae50-943f05838ca2","resolution":{"observed_at":"2026-08-07T14:31:29.145234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:29.235071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.235071Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:66fbeb462e78f7dd7dd6a8f355f3136cb78a64686f7b0ed8632753fb326c8f98","observation_id":"b218fa22-ac13-4868-b794-6871a4081663","resolution":{"observed_at":"2026-08-07T14:31:29.235071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:29.350980Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.350980Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:a48c68d09669f4bbe7180bd556a53ea64ffa5a1ac09237628dbf9fa978182d91","observation_id":"7524c893-8736-492b-b610-50b52f1b9e25","resolution":{"observed_at":"2026-08-07T14:31:29.350980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:31:29.480396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.480396Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d5a3f3d7b80a9ccfd8464c5ac5689e9831ade8843f23611ad3e77a0de847b047","observation_id":"449f4f89-6271-44b4-842c-49fd262ae3ad","resolution":{"observed_at":"2026-08-07T14:31:29.480396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-07T14:31:29.562683Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.562683Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:ccb651bcc5a051d89356d86eccd99d6ff3f38eef9e7777e8d53f537b6cd814a6","observation_id":"eccb1d5c-7590-45dd-9ae0-a37558cba8e2","resolution":{"observed_at":"2026-08-07T14:31:29.562683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01610","last_updated":"2023-06-02T21:52:17Z","snapshot_observed_at":"2026-08-02T17:50:59.894886Z","submitted_at":"2023-05-02T17:13:55Z","title":"Finding Neurons in a Haystack: Case Studies with Sparse Probing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01610","snapshot_observed_at":"2026-08-07T14:31:29.711577Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.711577Z"},"links":{"cited_paper":"/paper/2305.01610","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:6fb9fe6fdcc4d35fe505d09945e9ca33375f931953dbbdc9d481b69781664752","observation_id":"6deba5fe-bdc3-4692-b2bc-1b2846e5a728","resolution":{"observed_at":"2026-08-07T14:31:29.711577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15786","last_updated":"2024-10-17T02:43:35Z","snapshot_observed_at":"2026-08-03T10:43:35.890260Z","submitted_at":"2024-06-22T08:41:48Z","title":"What Matters in Transformers? Not All Attention is Needed","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15786","snapshot_observed_at":"2026-08-07T14:31:29.831992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.831992Z"},"links":{"cited_paper":"/paper/2406.15786","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:ae85e5b6fcd77e443815018bec836e2d39ded6238034810fd2d1343820d4372c","observation_id":"918385e5-c8fd-438b-af29-be0863fa735a","resolution":{"observed_at":"2026-08-07T14:31:29.831992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T14:31:29.934219Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:29.934219Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:2fb95e609e4520b29222fcdea77b35cc759584f2c3d7ab1a82c12f4618724205","observation_id":"590bb7f6-01dd-43f0-9581-0b2568848054","resolution":{"observed_at":"2026-08-07T14:31:29.934219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T14:31:30.037548Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.037548Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:014b9ac29a6bedca5ed28ffdd5b3eba464cde1d19120fa9b1807e721df13b9ba","observation_id":"e5ef0ee0-6a1c-447a-83e8-4be1ca203720","resolution":{"observed_at":"2026-08-07T14:31:30.037548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T14:31:30.157611Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.157611Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:7bedffafe43ae997a7d7cdaa949be7322b6b07934a3d39cebbe528ca06187384","observation_id":"8c379141-7c9d-4a13-98e6-83088b10b25f","resolution":{"observed_at":"2026-08-07T14:31:30.157611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T14:31:30.278340Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.278340Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:273b7db8464b114f1b27eb57a8bd2149e23cc21ccda52ef2887e3ccd46160e55","observation_id":"81f3a25d-a88f-4abb-88a7-d0195b4e09a4","resolution":{"observed_at":"2026-08-07T14:31:30.278340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T14:31:30.406842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.406842Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:e189ba9c2eed301a66956fa4b34649b4e1df5f73992d8a47d7812ba591c42b86","observation_id":"2704a0b4-d1c1-4c73-ab66-799454279de7","resolution":{"observed_at":"2026-08-07T14:31:30.406842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.963571Z","title":null,"venue":null,"work_id":"d2010034-3482-48ba-98c1-a14795471a88","year":2018},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.510582Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:7737e889278b72d0941a6798abf1f115f7615450fe5873fa0c4f7772233b2452","observation_id":"6c6689c1-ae77-4cb2-95f8-ec70cf1ab2d3","resolution":{"observed_at":"2026-08-07T14:31:35.001913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10102","last_updated":"2020-10-06T15:15:38Z","snapshot_observed_at":"2026-07-06T09:14:07.163697Z","submitted_at":"2020-04-21T15:22:27Z","title":"Attention is Not Only a Weight: Analyzing Transformers with Vector Norms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10102","snapshot_observed_at":"2026-08-07T14:31:30.642317Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.642317Z"},"links":{"cited_paper":"/paper/2004.10102","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:a2cee2786d740724a984959f4e0ba310bde8561cd8dda3814559d76e2b1869dd","observation_id":"4b2f79d3-b2cc-495a-8905-6f0a1a999fd0","resolution":{"observed_at":"2026-08-07T14:31:30.642317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:30.766556Z","title":null,"venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.766556Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:54c3330f8560d3181664e03e8791acac85e942ce39f8704af586d1d92a338cac","observation_id":"4afe106d-50bd-4688-a1e6-16cc076945c4","resolution":{"observed_at":"2026-08-07T14:31:30.766556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17760","last_updated":"2023-11-02T17:34:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-31T01:09:00Z","title":"CAMEL: Communicative Agents for \"Mind\" Exploration of Large Language Model Society","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17760","snapshot_observed_at":"2026-08-07T14:31:30.854478Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.854478Z"},"links":{"cited_paper":"/paper/2303.17760","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:82471bcabf89db0e4a44f8923ca5119652f96746f05c5ddb1c89feadad4698e6","observation_id":"d687d74e-1276-4ac5-b3a6-f3b05d130900","resolution":{"observed_at":"2026-08-07T14:31:30.854478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06259","last_updated":"2024-03-12T05:22:46Z","snapshot_observed_at":"2026-07-06T16:05:23.421896Z","submitted_at":"2023-08-11T17:47:54Z","title":"Self-Alignment with Instruction Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06259","snapshot_observed_at":"2026-08-07T14:31:30.967170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:30.967170Z"},"links":{"cited_paper":"/paper/2308.06259","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:16bf895921d115e2715045b09d785e70856662019fd8d29ffb277677c5dbcbea","observation_id":"64a8319a-333e-491b-9423-ef1d4d148fef","resolution":{"observed_at":"2026-08-07T14:31:30.967170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05062","last_updated":"2023-11-03T15:11:02Z","snapshot_observed_at":"2026-07-06T14:40:42.716626Z","submitted_at":"2023-01-12T14:59:19Z","title":"Tracr: Compiled Transformers as a Laboratory for Interpretability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05062","snapshot_observed_at":"2026-08-07T14:31:31.067719Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.067719Z"},"links":{"cited_paper":"/paper/2301.05062","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:6a9bf4de40e4bf0152518a9a345ca82074ed371905e4fcaf01192dca6512cd1d","observation_id":"979f2315-7f74-4c7a-b4be-f9e0bbab45c0","resolution":{"observed_at":"2026-08-07T14:31:31.067719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-07T14:31:31.194951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.194951Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:8d9f5d480bb1b4735216ff290f444958abab9527884685a8e2d0b363ca4ff782","observation_id":"97bd01b6-1b85-48d2-9753-020294d717fa","resolution":{"observed_at":"2026-08-07T14:31:31.194951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:31.302083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.302083Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d78cd6c1dacf4b2ca5f5774c6e74f658755478e61cb9985d2063230da7a63cea","observation_id":"0e6737d6-de1f-4fe7-a4fe-5d70f022f56d","resolution":{"observed_at":"2026-08-07T14:31:31.302083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T14:31:31.404139Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.404139Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:bb766035290a9ffa61fafe95a2b1a97085c702bf3cabea69cb0036b2a4c3542d","observation_id":"486d1769-54ed-4ed6-814e-148ce77bf323","resolution":{"observed_at":"2026-08-07T14:31:31.404139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.833623Z","title":null,"venue":null,"work_id":"9c82c745-508f-4b11-aaff-fb1dc5a7911d","year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.501559Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d18dbea25550a9c08f9e6604b46efae0d82ee6d7665c4879f765e65a27b00fbd","observation_id":"ad4c70ed-0f9d-4881-8530-01c739bcfa90","resolution":{"observed_at":"2026-08-07T14:31:34.866323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:31.595503Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.595503Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:b1b3e1cbece9a0144a0bc0eb3062d97305186c0f3ca24db5f723728fd9073251","observation_id":"4f5a4533-f3d9-4977-952b-623bcea19b56","resolution":{"observed_at":"2026-08-07T14:31:31.595503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:31.666536Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.666536Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:24082b0aedae6d6e4f32ec76511a6779463c48162b0d14d07dd7c28d720840e9","observation_id":"f4e31004-e61f-40c1-ba45-a31b184db5bf","resolution":{"observed_at":"2026-08-07T14:31:31.666536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T14:31:31.761101Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.761101Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:08e0fed2962c7d07f36227f3e78441feea5c6f6dd85e88cf108aae74dad9edfd","observation_id":"8af8f3e5-bd33-4ce5-a54f-5072783ce989","resolution":{"observed_at":"2026-08-07T14:31:31.761101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-07T14:31:31.849387Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.849387Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:2a42ba442b8b2889de98a7f84459f314774af7183dff3406a197f6168d7523f5","observation_id":"e64c05be-3c0d-4cb6-af46-53873a7bc191","resolution":{"observed_at":"2026-08-07T14:31:31.849387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.679544Z","title":null,"venue":null,"work_id":"cdc9bb63-dbb1-4fe1-b514-045f6d32effa","year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:31.954501Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:038dcc615a405197d404b0efb536aac91cdf5fe97f774549abc84f26c273152f","observation_id":"b7d3b25c-f191-430c-ac8f-ed34f5a650f7","resolution":{"observed_at":"2026-08-07T14:31:34.735750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:31:32.052031Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.052031Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:5b7274dc8bdb1c1e9028ceab66b26750de784a4ab620ca2ff1ae447ab83cd914","observation_id":"981ad702-cc8d-4d45-bd77-2154f2fa67ba","resolution":{"observed_at":"2026-08-07T14:31:32.052031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17875","last_updated":"2025-04-08T09:44:28Z","snapshot_observed_at":"2026-07-06T19:38:26.783620Z","submitted_at":"2024-10-23T13:47:05Z","title":"Understanding Layer Significance in LLM Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17875","snapshot_observed_at":"2026-08-07T14:31:32.111283Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.111283Z"},"links":{"cited_paper":"/paper/2410.17875","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:abae440ddfc5849ce6ec96a4855ca8141ed220b515facd090aa3ccc88eeefe8e","observation_id":"8dd4675c-195f-4605-bec4-b5cc7d9322ad","resolution":{"observed_at":"2026-08-07T14:31:32.111283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.153475Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.153475Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:b96f9e609f8a5351faab7e0607fbd02bec2a6bc366b9f71903e7144b543642c4","observation_id":"08d80dd0-3701-4fa8-9e2e-941934906b56","resolution":{"observed_at":"2026-08-07T14:31:32.153475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.197950Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.197950Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:dc5bc7f4b8977d8b98d065f4894da911032db722aa9150c221f9b7981ab9ecdb","observation_id":"bca95598-38e5-47ae-8c32-7f6f9d368cab","resolution":{"observed_at":"2026-08-07T14:31:32.197950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.265693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.265693Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d6d550ec1960463c6e5cfc6fdbe2ae981cf36c9d780bf98b035682f89fa31ed2","observation_id":"ca6c3d00-d951-4448-868e-786c362c07a0","resolution":{"observed_at":"2026-08-07T14:31:32.265693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15891","last_updated":"2024-07-22T01:12:23Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-22T01:12:23Z","title":"RazorAttention: Efficient KV Cache Compression Through Retrieval Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15891","snapshot_observed_at":"2026-08-07T14:31:32.305566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.305566Z"},"links":{"cited_paper":"/paper/2407.15891","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:af2b83182fc496cb1103af667f969f24e1ce0a09d697f9eb95a76092af14ec71","observation_id":"602385b1-1311-41ea-aaff-2b45caeb9329","resolution":{"observed_at":"2026-08-07T14:31:32.305566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.340173Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.340173Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:e5bff461e5d0dad82003abffd7f9ad46742814d9b8a7b752735a3f3322758f9d","observation_id":"c2ccc7ab-5162-428e-b9e7-c882c54a67d0","resolution":{"observed_at":"2026-08-07T14:31:32.340173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T14:31:32.380540Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.380540Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:df5d8a77ea3337c19ff5d9af66be680667a848b32a662fe8ca7f7451f89cc0dd","observation_id":"62ff896b-316e-4bae-bd48-54bc2cfc4364","resolution":{"observed_at":"2026-08-07T14:31:32.380540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.426928Z","title":null,"venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.426928Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:de8eead834e0358af5f39c846fcd87c7facd8546281c4320032c4822d548f721","observation_id":"007b0abb-ea24-4321-b6f6-0491b3a7c4c4","resolution":{"observed_at":"2026-08-07T14:31:32.426928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09418","last_updated":"2019-06-07T14:00:58Z","snapshot_observed_at":"2026-08-01T19:51:24.042109Z","submitted_at":"2019-05-23T01:13:24Z","title":"Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.09418","snapshot_observed_at":"2026-08-07T14:31:32.459562Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.459562Z"},"links":{"cited_paper":"/paper/1905.09418","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:ebc45818e494dcb10a41f5e6edb2354d362fcf5f3df9377d33bc7038789ef2c5","observation_id":"0347abd5-acf9-4974-b291-be8aaed9ab4e","resolution":{"observed_at":"2026-08-07T14:31:32.459562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T14:31:32.512737Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.512737Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d07afca52c2743b922b144ceeff764fcdc5dbeb4093967a9437ab48a6dc1a651","observation_id":"3d0d45d0-175c-4d80-830d-6149eb3feeca","resolution":{"observed_at":"2026-08-07T14:31:32.512737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-07-06T14:33:11.945106Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T14:31:32.555070Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.555070Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:0b1f28a73fa3898c93d0d3eb211f106bcf8d0ae0d564112b2b48c8b745abd8a9","observation_id":"e501691c-1645-4f2f-8dba-2eb2428502a2","resolution":{"observed_at":"2026-08-07T14:31:32.555070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-07T14:31:32.600105Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.600105Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:e6dc0dd13ba3e277986305d50f78393a25505faf143afb33b9c672d7e1eac29d","observation_id":"f4f0e6c6-28f6-4fdd-951a-3ef3c40320c6","resolution":{"observed_at":"2026-08-07T14:31:32.600105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15574","last_updated":"2024-04-24T00:24:03Z","snapshot_observed_at":"2026-08-06T03:07:12.026697Z","submitted_at":"2024-04-24T00:24:03Z","title":"Retrieval Head Mechanistically Explains Long-Context Factuality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15574","snapshot_observed_at":"2026-08-07T14:31:32.659055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.659055Z"},"links":{"cited_paper":"/paper/2404.15574","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:4e967b235760f63fccf3cb48a9401a3a91f16282724c9cc3d2b6d1abc5a86395","observation_id":"06e312a4-ee12-416a-9d35-8c51fd801692","resolution":{"observed_at":"2026-08-07T14:31:32.659055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-07T14:31:32.737156Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.737156Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:5bcf38b4bc4b783c7fbfe0fe575ed4070f5c9b31e4dc3826487bf91b6ff09ffb","observation_id":"67ea79f2-a1e4-4403-afe2-4ffb96e10d9f","resolution":{"observed_at":"2026-08-07T14:31:32.737156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:31:32.776824Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.776824Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:95c8e2fae8d03a40ac61f960b92b423f67092c3a3bfccac0f0437b7e364e4a6a","observation_id":"50f67d49-6bb9-4674-89df-c916ae0d09e3","resolution":{"observed_at":"2026-08-07T14:31:32.776824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T14:31:32.837071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.837071Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:97c77347e3cba892d95dbc5814e18ba197f8e3fa17c355a2c664e4e8dce28bc3","observation_id":"bd355200-13da-49af-9c8e-91d838aae586","resolution":{"observed_at":"2026-08-07T14:31:32.837071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-07T14:31:32.881126Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.881126Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:76eea2226dea33c301152a90d1a771b8586b4bbaabab43adbc38e772f8f40ce6","observation_id":"055e1336-85e1-4ffe-8fa6-302af0834c01","resolution":{"observed_at":"2026-08-07T14:31:32.881126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:32.925153Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.925153Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:6e4d4694263f3799d0ee91c4840573c825ba04c15c88f312043dcda0248acae6","observation_id":"a5f9e173-b3f6-45a3-bb56-2945050b15af","resolution":{"observed_at":"2026-08-07T14:31:32.925153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T14:31:32.962678Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.962678Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:2fb2158f28893ea35b9f16202b0c1016f0735b111513fb4f95b2d96c9ecdcc62","observation_id":"d3d3c1e9-2f27-44b9-b215-65696141f1e7","resolution":{"observed_at":"2026-08-07T14:31:32.962678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-07T14:31:33.035007Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.035007Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:9e64e4274c15f3f3091c35e15529959e907efd5455e024e31c44ce5755354e36","observation_id":"698fa79a-24db-4df3-a301-20b075a410ff","resolution":{"observed_at":"2026-08-07T14:31:33.035007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:34.499679Z","title":null,"venue":null,"work_id":"0839370c-c520-490f-8b44-a3d41120beca","year":2022},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.075465Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:0f3a9637b2ef4417a122ce3602e13cc8e70d33ced762df7fa7937ef655303c50","observation_id":"35d71b34-931a-497d-afa2-bd2771374679","resolution":{"observed_at":"2026-08-07T14:31:34.560331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:33.117093Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.117093Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:df411e3a11c746cc83bc4496b808576bc43201a83e9db32c6e92d2480eb7f4bc","observation_id":"1422a35e-e4a2-479d-9136-1ef316589647","resolution":{"observed_at":"2026-08-07T14:31:33.117093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-07T14:31:33.160827Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.160827Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:b0d9a3e5b8e4df559a89375c440e2ef883c15101aeee84566a8e8cbe108adfb8","observation_id":"0d76108f-24e9-41f6-9e0b-36c2bfc2f040","resolution":{"observed_at":"2026-08-07T14:31:33.160827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13708","last_updated":"2025-02-24T13:31:08Z","snapshot_observed_at":"2026-07-06T19:35:26.421419Z","submitted_at":"2024-10-17T16:08:06Z","title":"On the Role of Attention Heads in Large Language Model Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13708","snapshot_observed_at":"2026-08-07T14:31:33.227557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.227557Z"},"links":{"cited_paper":"/paper/2410.13708","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:7c78eef8ab39adb3e7ec0cd037f69ff7fb851374d07079ea3251a500aca29915","observation_id":"4a4f6db7-a64c-4f3a-ab37-4ce4e0fb6e08","resolution":{"observed_at":"2026-08-07T14:31:33.227557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T14:31:33.361615Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.361615Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:0f70f720f83464b3807a7c4a88d033b7f11eda91305220c2d0cb2a1926acd233","observation_id":"032b8859-a205-4604-9524-72f73f9d0da2","resolution":{"observed_at":"2026-08-07T14:31:33.361615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:33.464952Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.464952Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:4dba11c8884cd4214783095b57122b4d2ee7ccbdc65018e4dfedf011517bff85","observation_id":"b20fdda5-bf19-437c-9b1e-c958a83cb0c8","resolution":{"observed_at":"2026-08-07T14:31:33.464952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:31:33.577852Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.577852Z"},"links":{"citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:d5af4c9b4fedf6c95d88c4720a3a8a04e41cb76621e076cc2a845eae69a695d7","observation_id":"d1623b5a-688c-4ca2-b154-928c47276e75","resolution":{"observed_at":"2026-08-07T14:31:33.577852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:23:08.135174Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":69,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2505.18799."}