{"as_of":"2026-08-08T21:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3fef19c0a43b3988ba894b173032c58f6f807b97cb446183e524fd1c2be8375","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:37:37.564248Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:41:05.394285Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T02:26:42.777951Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06415","snapshot_observed_at":"2026-08-07T15:41:05.394285Z","title":"Systematic outliers in large language models.arXiv preprint arXiv:2502.06415, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14302","last_updated":"2025-05-20T12:54:43Z","snapshot_observed_at":"2026-08-07T15:43:23.244437Z","submitted_at":"2025-05-20T12:54:43Z","title":"Scaling Law for Quantization-Aware Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:05.394285Z"},"links":{"cited_paper":"/paper/2502.06415","citing_paper":"/paper/2505.14302"},"observation_digest":"sha256:c337989273f18781e43b561e3d734d1c8f8eb66ed0c93f4cc1c408df9de8648a","observation_id":"18f7cfff-5082-4f97-b094-e30305d06dd1","resolution":{"observed_at":"2026-08-07T15:41:05.394285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.06415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06415","snapshot_observed_at":"2026-07-10T02:26:42.777951Z","title":"Systematic outliers in large language models","venue":"cs.CL","work_id":"5b7b454a-39df-464f-ac5e-d0c154670a7b","year":2025},"citing_paper":{"arxiv_id":"2512.02010","last_updated":"2026-05-09T05:39:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-01T18:59:45Z","title":"Four Over Six: More Accurate NVFP4 Quantization with Adaptive Block Scaling","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-17T02:23:01.845123Z"},"links":{"cited_paper":"/paper/2502.06415","citing_paper":"/paper/2512.02010"},"observation_digest":"sha256:29a4dac85135f35741bd09fd5afc3fcc64bfb74b2ac6913c7be8fe8eb7d42db2","observation_id":"b7fed80a-da5e-45d1-8316-1cb6f5785a61","resolution":{"observed_at":"2026-05-17T02:23:52.779263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.06415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06415","snapshot_observed_at":"2026-07-10T02:26:42.777951Z","title":"Systematic outliers in large language models","venue":"cs.CL","work_id":"5b7b454a-39df-464f-ac5e-d0c154670a7b","year":2025},"citing_paper":{"arxiv_id":"2601.14004","last_updated":"2026-04-14T03:49:06Z","snapshot_observed_at":"2026-07-31T09:24:49.481740Z","submitted_at":"2026-01-20T14:23:23Z","title":"Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T12:39:57.398423Z"},"links":{"cited_paper":"/paper/2502.06415","citing_paper":"/paper/2601.14004"},"observation_digest":"sha256:e8ddfaedb1415f23cf1ba6dfcbaefcf2e44625c6410ece9bf182b641d7771c3b","observation_id":"04572805-1ac4-4057-b47d-53c2646ac69b","resolution":{"observed_at":"2026-05-16T12:40:54.608787Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.06415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06415","snapshot_observed_at":"2026-07-10T02:26:42.777951Z","title":"Systematic outliers in large language models","venue":"cs.CL","work_id":"5b7b454a-39df-464f-ac5e-d0c154670a7b","year":2025},"citing_paper":{"arxiv_id":"2604.18231","last_updated":"2026-05-06T14:26:07Z","snapshot_observed_at":"2026-08-08T13:51:21.834089Z","submitted_at":"2026-04-20T13:13:31Z","title":"AgenTEE: Confidential LLM Agent Execution on Edge Devices","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T04:46:53.351566Z"},"links":{"cited_paper":"/paper/2502.06415","citing_paper":"/paper/2604.18231"},"observation_digest":"sha256:159a4e76f8d6f8177a6cfbce984d06f11ee231575f9ba520e5de448fde0c4bc2","observation_id":"cacc7e82-bb33-4d6c-be06-62efc0d8d853","resolution":{"observed_at":"2026-05-10T11:40:19.391720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.06415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06415","snapshot_observed_at":"2026-07-10T02:26:42.777951Z","title":"Systematic outliers in large language models","venue":"cs.CL","work_id":"5b7b454a-39df-464f-ac5e-d0c154670a7b","year":2025},"citing_paper":{"arxiv_id":"2605.16147","last_updated":"2026-07-06T18:29:27Z","snapshot_observed_at":"2026-08-03T00:35:38.299188Z","submitted_at":"2026-05-15T16:27:10Z","title":"Registers Matter for Pixel-Space Diffusion Transformers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T19:08:23.052621Z"},"links":{"cited_paper":"/paper/2502.06415","citing_paper":"/paper/2605.16147"},"observation_digest":"sha256:1b74f43f4ea81bf620b44100638d7b92de60eb89ecc9bb8bf467959449dd2b63","observation_id":"c7908c12-71b6-41d9-a7fb-caabaaaaeb57","resolution":{"observed_at":"2026-05-20T19:08:54.034109Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.06415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06415","snapshot_observed_at":"2026-07-10T02:26:42.777951Z","title":"Systematic outliers in large language models","venue":"cs.CL","work_id":"5b7b454a-39df-464f-ac5e-d0c154670a7b","year":2025},"citing_paper":{"arxiv_id":"2605.19660","last_updated":"2026-05-19T10:53:03Z","snapshot_observed_at":"2026-08-02T21:06:34.067413Z","submitted_at":"2026-05-19T10:53:03Z","title":"OScaR: The Occam's Razor for Extreme KV Cache Quantization in LLMs and Beyond","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T07:57:51.032025Z"},"links":{"cited_paper":"/paper/2502.06415","citing_paper":"/paper/2605.19660"},"observation_digest":"sha256:0a215a6c102057d1f33904bf6bbefabe7e53e2e8a53dc848c9621fa5bac4e9a1","observation_id":"dc9d6ca1-9a3a-4a0b-8368-cba5d646fb61","resolution":{"observed_at":"2026-05-20T07:58:07.649938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.06415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06415","snapshot_observed_at":"2026-07-10T02:26:42.777951Z","title":"Systematic outliers in large language models","venue":"cs.CL","work_id":"5b7b454a-39df-464f-ac5e-d0c154670a7b","year":2025},"citing_paper":{"arxiv_id":"2607.08733","last_updated":"2026-07-09T17:35:00Z","snapshot_observed_at":"2026-08-02T05:29:30.584488Z","submitted_at":"2026-07-09T17:35:00Z","title":"Super Weights in LLMs and the Failure of Selective Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-10T02:26:06.457776Z"},"links":{"cited_paper":"/paper/2502.06415","citing_paper":"/paper/2607.08733"},"observation_digest":"sha256:f13dc55d4096298ee98047483090dbc4a9139fdeb037948403de663fcfbbe327","observation_id":"a3f4058f-d427-4686-a6f3-52ab0e7e9cbe","resolution":{"observed_at":"2026-07-10T02:26:42.779156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06415/citation-record","integrity":"/paper/2502.06415/integrity","json":"/paper/2502.06415/citation-record.json","paper":"/paper/2502.06415"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T15:37:37.358171Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.358171Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:ae2c37de3dab9d1da3d4ffcabe04b6e836e352b8a0291aece91f233ce277174b","observation_id":"977cd189-8922-48ed-ab68-51538d021031","resolution":{"observed_at":"2026-08-08T15:37:37.358171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-08T15:37:37.362221Z","title":"The falcon series of open language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.362221Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:84a99d28f94be42792f68fa87a82b11713e866ac5ce76ef8c3ff175a54711769","observation_id":"8dee28f5-d110-4ab7-9a72-dec936a0d72b","resolution":{"observed_at":"2026-08-08T15:37:37.362221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-08T15:37:37.394184Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.394184Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:a0cbbdca93b37adbd17380919ebd6fd9d35493d60022b83f45e9f4472e52c336","observation_id":"0575314d-d7c4-4971-9357-f904ad994828","resolution":{"observed_at":"2026-08-08T15:37:37.394184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.431037Z","title":"Redpajama: an open dataset for training large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.431037Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:8dfdabac5c36e74eff53e7fe582606f6fcd983d58d8d2dabe158120bb966c988","observation_id":"3c8aac69-483b-4907-bf51-444c22599a1e","resolution":{"observed_at":"2026-08-08T15:37:37.431037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.461727Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.461727Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:655197c93eae535045a12846f9f08a62d343d2628d94959b9c4c5b9ebf14b391","observation_id":"046a9018-cc19-4d79-902d-2b540df1687c","resolution":{"observed_at":"2026-08-08T15:37:37.461727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T15:37:37.464463Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.464463Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:f0952df84031b1490e574108afbff58ae6e6ccb2020668c451db3b9a792075b8","observation_id":"2c6323da-2f88-42b5-af4d-24139eebbb88","resolution":{"observed_at":"2026-08-08T15:37:37.464463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.467687Z","title":"Sigmoid-weighted linear units for neural network function approximation in reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.467687Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:04c6b64a2543b3d39d050ce48d575b34f9e6bf774a1d5217ab7c7e620fa02746","observation_id":"ca1d7415-ea50-4a64-a6b2-0bc349907e73","resolution":{"observed_at":"2026-08-08T15:37:37.467687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.18079","last_updated":"2025-05-28T18:58:29Z","snapshot_observed_at":"2026-08-05T09:48:25.127042Z","submitted_at":"2024-01-31T18:58:14Z","title":"KVQuant: Towards 10 Million Context Length LLM Inference with KV Cache Quantization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.18079","snapshot_observed_at":"2026-08-08T15:37:37.470136Z","title":"Kvquant: Towards 10 million context length llm inference with kv cache quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.470136Z"},"links":{"cited_paper":"/paper/2401.18079","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:f935b0cd415e5677700998ce4116db9a8f5b816dc44301f96d48f644b7967331","observation_id":"9fe47305-c1fb-4cdd-a013-2f6bdd13060f","resolution":{"observed_at":"2026-08-08T15:37:37.470136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.829907Z","title":"Phi-2: The surprising power of small language models, 2023","venue":null,"work_id":"031e1a9f-52ee-48c4-b6cf-863128358370","year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.473009Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:787539f5b624de7c9177ca5f693cc20bade19692eb71356f5d383ef7832bc258","observation_id":"35ed6f44-adb8-435b-855d-44cb71991107","resolution":{"observed_at":"2026-08-08T15:37:37.833314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T15:37:37.476547Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.476547Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:6df738920bf6738ac2e6e98286e7f352920a30c206b609c118834240fa2e6f94","observation_id":"a6b527a2-1a53-43bb-bd41-c4d07b736148","resolution":{"observed_at":"2026-08-08T15:37:37.476547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.821138Z","title":null,"venue":null,"work_id":"25969e9a-cf2e-4421-b1d9-e76409ca6550","year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.480549Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:58684bca09f363349508861981de1a1b1cc0141d0cd9bb7b00a98ee75c99d19f","observation_id":"0a4e7dea-4561-4d7f-a890-4ab7fad82bdd","resolution":{"observed_at":"2026-08-08T15:37:37.824253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.811846Z","title":"A github link forked from jzhang38/tinyllama","venue":null,"work_id":"0a5051b2-4c25-489a-bf01-f4b2569b91f2","year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.483854Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:877f6b561256b74aea5679d2ca003d9f7f29c177fdf449cbd0c7710cbac73838","observation_id":"2edf1106-6bd1-437e-b9d2-9bf0b707814f","resolution":{"observed_at":"2026-08-08T15:37:37.815361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.06990","last_updated":"2021-06-02T18:09:50Z","snapshot_observed_at":"2026-08-04T23:13:25.919699Z","submitted_at":"2021-05-14T17:54:28Z","title":"BERT Busters: Outlier Dimensions that Disrupt Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.06990","snapshot_observed_at":"2026-08-08T15:37:37.487034Z","title":"Bert busters: Outlier dimensions that disrupt transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.487034Z"},"links":{"cited_paper":"/paper/2105.06990","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:7a857fa83e28ed65988d4267305a85a0552610ed6417983f627b748b25473837","observation_id":"ed53685a-a624-4e28-a71e-3075d0139adb","resolution":{"observed_at":"2026-08-08T15:37:37.487034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12102","last_updated":"2024-02-19T12:45:52Z","snapshot_observed_at":"2026-07-06T17:32:10.828230Z","submitted_at":"2024-02-19T12:45:52Z","title":"Is It a Free Lunch for Removing Outliers during Pretraining?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12102","snapshot_observed_at":"2026-08-08T15:37:37.490479Z","title":"Is it a free lunch for removing outliers during pretraining? arXiv preprint arXiv:2402.12102, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.490479Z"},"links":{"cited_paper":"/paper/2402.12102","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:1f44a61177466ab6fed58dcf990e1fb9918e7d8e2e9b7430a0483952d8eb447f","observation_id":"6eecf4b6-8be3-4404-a18f-cf9af539391b","resolution":{"observed_at":"2026-08-08T15:37:37.490479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01721","last_updated":"2024-11-01T17:12:53Z","snapshot_observed_at":"2026-08-07T04:58:45.510275Z","submitted_at":"2024-06-03T18:27:44Z","title":"DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01721","snapshot_observed_at":"2026-08-08T15:37:37.493686Z","title":"Rotation and permutation for advanced outlier management and efficient quantization of llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.493686Z"},"links":{"cited_paper":"/paper/2406.01721","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:c60d8640306adeb69621d6f58b5b7c5f3907052d5ab5a26e8144fe59379c818e","observation_id":"a004b574-971a-4575-ac1e-857b6769ef79","resolution":{"observed_at":"2026-08-08T15:37:37.493686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.802620Z","title":"Introducing mpt-7b: A new standard for open-source, commercially usable llms, 2023","venue":null,"work_id":"e4aa0323-5dce-4bd3-a219-3a43be6fa8f2","year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.496924Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:dc4670744bdd16d928bba3e5a72455780746c2ef74c419ef0a36873f915dfe65","observation_id":"31b39ea6-caa1-4484-b291-37bddbb1028a","resolution":{"observed_at":"2026-08-08T15:37:37.805913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03605","last_updated":"2024-08-26T20:48:19Z","snapshot_observed_at":"2026-08-04T21:48:31.671465Z","submitted_at":"2024-04-04T17:25:30Z","title":"Mitigating the Impact of Outlier Channels for Language Model Quantization with Activation Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03605","snapshot_observed_at":"2026-08-08T15:37:37.499961Z","title":"Mitigating the impact of outlier channels for language model quantization with activation regularization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.499961Z"},"links":{"cited_paper":"/paper/2404.03605","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:8a4991fa7acaf1629b829107a71e9aca52c94dee1c39bcfb3db28ec833be3b40","observation_id":"af7eab10-dba9-414d-b441-8c4cdfbe98f2","resolution":{"observed_at":"2026-08-08T15:37:37.499961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.503555Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.503555Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:1a3e8dfb862d5a7097f1d37eb6c1b5e304f52bc00c39199296a4ecfd0cff99eb","observation_id":"835cd84d-ba6c-4dbd-90a8-06be18dc6b38","resolution":{"observed_at":"2026-08-08T15:37:37.503555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20835","last_updated":"2024-06-05T09:53:18Z","snapshot_observed_at":"2026-08-08T04:43:20.434741Z","submitted_at":"2024-05-31T14:24:33Z","title":"Outliers and Calibration Sets have Diminishing Effect on Quantization of Modern LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20835","snapshot_observed_at":"2026-08-08T15:37:37.506565Z","title":"Outliers and calibration sets have diminishing effect on quantization of modern llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.506565Z"},"links":{"cited_paper":"/paper/2405.20835","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:fecbc0037def2f1280af56511ff0687f3e1e12161d62a704458ec02131540c92","observation_id":"ecab0da4-1727-4c02-bcbc-b058837cb5fe","resolution":{"observed_at":"2026-08-08T15:37:37.506565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.789045Z","title":null,"venue":null,"work_id":"af0d4cea-c825-4721-9543-123b32d9f52a","year":2021},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.509740Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:943c2baa0a5487aaa39bb1b30cc373b82bfc73dbf2eb7d83068e7ee81d38f81e","observation_id":"8fd5e80a-707b-4288-996a-1201173f823d","resolution":{"observed_at":"2026-08-08T15:37:37.792165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.512786Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.512786Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:beae33cbed7fdaab59d1641ed0c0e92252cb3f0319d7d146eccd061aa9d3158d","observation_id":"c6723273-19a9-4644-b6dd-501f232f704f","resolution":{"observed_at":"2026-08-08T15:37:37.512786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04431","last_updated":"2025-01-22T01:18:51Z","snapshot_observed_at":"2026-07-06T19:11:40.618767Z","submitted_at":"2024-09-06T17:53:26Z","title":"Theory, Analysis, and Best Practices for Sigmoid Self-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04431","snapshot_observed_at":"2026-08-08T15:37:37.515845Z","title":"Theory, analysis, and best practices for sigmoid self-attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.515845Z"},"links":{"cited_paper":"/paper/2409.04431","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:950bc5515cc1be727c2dac083712809eb66c42a07a38be9f780bf21a33aa130c","observation_id":"1fbe8f8a-bc61-4074-905e-185e3b70a6d6","resolution":{"observed_at":"2026-08-08T15:37:37.515845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-08T15:37:37.519103Z","title":"Glu variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.519103Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:ade81da2f3bb64f30970b8d60a6c5acbc3cf586ae4ee69b4d8faeb06711463bd","observation_id":"672375f2-6ff0-4510-afa8-ad7dedc2b92a","resolution":{"observed_at":"2026-08-08T15:37:37.519103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-08T15:37:37.522321Z","title":"A simple and effective pruning approach for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.522321Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:a3d4477c1de0bd7e176b40749a2f5205400c1e7852d84b7ea3118b8173423321","observation_id":"2dc9d5cb-4384-47f8-bc37-f1a763fc8e60","resolution":{"observed_at":"2026-08-08T15:37:37.522321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17762","snapshot_observed_at":"2026-08-08T15:37:37.525550Z","title":"Massive activations in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.525550Z"},"links":{"cited_paper":"/paper/2402.17762","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:458aa5c88d8a65bbeb3afb051c3f823afa3471b99bc1ecd12173746e7147cd56","observation_id":"2ac3d208-f294-4d75-aeee-520b786000be","resolution":{"observed_at":"2026-08-08T15:37:37.525550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-08T15:37:37.528795Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.528795Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:cb86be19a536d3eb45c93ce6d2ab83a7d1e6ea9350cfc9e11ef261f48732c19e","observation_id":"c1a225f8-e085-419b-86f4-f5bba29b61aa","resolution":{"observed_at":"2026-08-08T15:37:37.528795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T15:37:37.531978Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.531978Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:dd99ecd0ed8e170eb4a898e56e2f9b7a3cec713f6faf20004596d157d6e386a6","observation_id":"67f432f0-4e32-4d47-a93d-cdac0be07864","resolution":{"observed_at":"2026-08-08T15:37:37.531978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.535129Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.535129Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:39269a2f48ab475d89ff7517186c1149c805f080d5376b7f4568b6994fda653e","observation_id":"0293f130-d7e9-4e7b-a15f-27ab168209d4","resolution":{"observed_at":"2026-08-08T15:37:37.535129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.767865Z","title":"Outlier suppression: Pushing the limit of low-bit transformer language models","venue":null,"work_id":"3fcbbe9f-d6d8-446e-a2f4-51f03469b460","year":2022},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.537551Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:46a99e28ee9b864ec4db3d5c189e0ea7e0ff496f0e106b62ad70f5ee5a3e0f8d","observation_id":"cf17b31b-217c-4bdc-92e0-69c914c09aa9","resolution":{"observed_at":"2026-08-08T15:37:37.772894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.539937Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.539937Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:6fb1c7492a3357402b1e515838c3d84ace7c085e6284763b6e9b3f535cd4c827","observation_id":"60878c4f-a91b-4e1c-88d6-9e0a032a1d68","resolution":{"observed_at":"2026-08-08T15:37:37.539937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-08T15:37:37.542196Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.542196Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:bd72d7bc120cbf1325256ea843ff4d0cda3c1161fdf5fd976b25783c5dd70dd5","observation_id":"ec6b186a-ad2c-4bed-a4d3-59a0df020972","resolution":{"observed_at":"2026-08-08T15:37:37.542196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05175","last_updated":"2025-06-30T22:16:39Z","snapshot_observed_at":"2026-08-01T08:08:15.221032Z","submitted_at":"2023-10-08T14:22:58Z","title":"Outlier Weighed Layerwise Sparsity (OWL): A Missing Secret Sauce for Pruning LLMs to High Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05175","snapshot_observed_at":"2026-08-08T15:37:37.544678Z","title":"Outlier weighed layerwise sparsity (owl): A missing secret sauce for pruning llms to high sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.544678Z"},"links":{"cited_paper":"/paper/2310.05175","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:b89cb4cebff1bb5eba68a444e67e60923ac57c3a30005b7d3b9cb879ac832c9c","observation_id":"d13183e9-b65c-4b3f-bdb4-2e5a59b3ff48","resolution":{"observed_at":"2026-08-08T15:37:37.544678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-08T15:37:37.547404Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.547404Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:d3e4c63e1d97f290fdd56de5950ac0372fb8195779d1ff6aad563412a02545d8","observation_id":"1eca9cde-ce5a-49b6-8d67-e972152c81b2","resolution":{"observed_at":"2026-08-08T15:37:37.547404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14700","last_updated":"2024-05-30T17:31:46Z","snapshot_observed_at":"2026-08-06T16:37:08.679537Z","submitted_at":"2024-02-22T16:56:13Z","title":"Unveiling Linguistic Regions in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14700","snapshot_observed_at":"2026-08-08T15:37:37.550708Z","title":"Unveiling linguistic regions in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.550708Z"},"links":{"cited_paper":"/paper/2402.14700","citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:3dc579ca598b66e696282674f9eaa9d7cc397fb8ecf8f894970332b797b44d4a","observation_id":"f2cb38a1-3ad3-42ae-9e50-21b3d8ca0648","resolution":{"observed_at":"2026-08-08T15:37:37.550708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.553901Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.553901Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:66cdd7577addbdf3a772a749006a450927e31047e4b59c54ed371b0f4853b2a7","observation_id":"ef70c818-0913-429e-bc25-9b03c148b8a3","resolution":{"observed_at":"2026-08-08T15:37:37.553901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.557821Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.557821Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:e8633a6669df099b9505a4452a4f8484b5f517f6aa4ac51c2fc5157d4abd8b09","observation_id":"da0761d7-04c5-4914-9e28-b611371f5947","resolution":{"observed_at":"2026-08-08T15:37:37.557821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.561233Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.561233Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:4c1efe8e5466c2cf47c7d837e00c74f45dcc3f3c2320828fc3fd274ae7e2796b","observation_id":"e0d55b37-3cf4-4a38-9a16-df4594bdaa6b","resolution":{"observed_at":"2026-08-08T15:37:37.561233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:37:37.564248Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T15:37:37.564248Z"},"links":{"citing_paper":"/paper/2502.06415"},"observation_digest":"sha256:d2c0db6728ec7e6ce5fa7add21f38cba24def1222e0219a1e7c481fa59c38603","observation_id":"e41e3628-8899-4232-a75d-09690d220116","resolution":{"observed_at":"2026-08-08T15:37:37.564248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06415","last_updated":"2025-02-26T01:59:40Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T15:29:19.875570Z","submitted_at":"2025-02-10T12:54:17Z","title":"Systematic Outliers in Large Language Models"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 7 inbound Pith citation observations for arXiv:2502.06415."}