{"as_of":"2026-08-08T13:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ae7c97e6e77223847a684274fa7df5b1b0fe9f7176beda81be367cdab20ae2b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:30:37.736038Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":11,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":"2306.12929","doi":"10.48550/arxiv.2306.12929","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing, November 2023","venue":"arXiv (Cornell University)","work_id":"89445e0c-3933-4673-a0ca-d994606932cf","year":2023},"citing_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-16T07:02:53.740597Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2402.17762"},"observation_digest":"sha256:a27d5277b06bb3edd0966701158236c4b3e7afbff811c24292b2edfe4a6dc595","observation_id":"4d39c079-9da9-4fc0-9d7d-bea441bbf1b8","resolution":{"observed_at":"2026-05-16T07:02:53.971737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-07T13:30:37.736038Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21670","last_updated":"2025-05-27T18:48:40Z","snapshot_observed_at":"2026-08-07T23:42:58.100393Z","submitted_at":"2025-05-27T18:48:40Z","title":"Rethinking the Outlier Distribution in Large Language Models: An In-depth Study","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:37.736038Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2505.21670"},"observation_digest":"sha256:89917b4ab3150b278ea786ca65a89d0bdec7c60699b5651638993ee9df36335e","observation_id":"0081ecd2-ce4c-4844-b8fd-ca56779c8cfb","resolution":{"observed_at":"2026-08-07T13:30:37.736038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-07T10:43:43.611046Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-07T22:24:25.669880Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.611046Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:a2a9f5e03594f01ef5a2ea06c327c82b271a2981fdaf2c8587bb6e46573b05d0","observation_id":"c7a78b1e-bcb8-4804-99bd-ffe86490b644","resolution":{"observed_at":"2026-08-07T10:43:43.611046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-06T20:41:54.104960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03031","last_updated":"2025-07-03T01:05:24Z","snapshot_observed_at":"2026-08-06T20:31:59.685905Z","submitted_at":"2025-07-03T01:05:24Z","title":"On the Mathematical Impossibility of Safe Universal Approximators","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T20:41:54.104960Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2507.03031"},"observation_digest":"sha256:e9db8354e110e31c147a74b8cf1f770fface034b0468186eb2becbb56ba85544","observation_id":"97d43d9b-5efc-445c-b887-8668c52fb786","resolution":{"observed_at":"2026-08-06T20:41:54.104960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":"2306.12929","doi":"10.48550/arxiv.2306.12929","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing, November 2023","venue":"arXiv (Cornell University)","work_id":"89445e0c-3933-4673-a0ca-d994606932cf","year":2023},"citing_paper":{"arxiv_id":"2512.02010","last_updated":"2026-05-09T05:39:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-01T18:59:45Z","title":"Four Over Six: More Accurate NVFP4 Quantization with Adaptive Block Scaling","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T02:23:01.845123Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2512.02010"},"observation_digest":"sha256:d75f5c17dfd5c9f01e7333db8a43b43694c2494f55338fe07c5e950b17a7700e","observation_id":"81b3be1d-0219-4789-8cdd-03019ac48af3","resolution":{"observed_at":"2026-05-17T02:23:52.675264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":"2306.12929","doi":"10.48550/arxiv.2306.12929","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing, November 2023","venue":"arXiv (Cornell University)","work_id":"89445e0c-3933-4673-a0ca-d994606932cf","year":2023},"citing_paper":{"arxiv_id":"2602.01203","last_updated":"2026-05-27T09:56:04Z","snapshot_observed_at":"2026-08-04T22:42:52.512248Z","submitted_at":"2026-02-01T12:45:39Z","title":"Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T08:47:29.236561Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2602.01203"},"observation_digest":"sha256:b5a0316ede68f0dac1fad17fd6b9dead303bb091030062c906775e4b1a9fdb73","observation_id":"8fc71837-9e23-4202-864d-ff34f593ba80","resolution":{"observed_at":"2026-05-16T08:47:37.167558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-03T05:50:22.066445Z","title":"Quantizable transformers: Removing outliers by helping attention heads do nothing.ArXiv, abs/2306.12929,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01203","last_updated":"2026-05-27T09:56:04Z","snapshot_observed_at":"2026-08-04T22:42:52.512248Z","submitted_at":"2026-02-01T12:45:39Z","title":"Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T05:50:22.066445Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2602.01203"},"observation_digest":"sha256:30919d798c8d230be43c232d6f179010b00ceca99950ff008e5c50bbea211db2","observation_id":"a14c9409-2a34-4b7f-a3c9-3c23ae7a10ea","resolution":{"observed_at":"2026-08-03T05:50:22.066445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-06T21:47:33.826393Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":121,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:ea96d5527f3cc68efe0c7025e511240cea26ac8c59150a574f10e34dbba37550","observation_id":"ae71c389-0771-4836-b3d8-1164e0e794f3","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":"2306.12929","doi":"10.48550/arxiv.2306.12929","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing, November 2023","venue":"arXiv (Cornell University)","work_id":"89445e0c-3933-4673-a0ca-d994606932cf","year":2023},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:10dd46f8311b1988e5ff75ee6efb0d865fd8282df1f9e536b1ee4772762adc3b","observation_id":"8748b626-7867-4533-8e98-906fb766a7f3","resolution":{"observed_at":"2026-06-28T23:32:46.734785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":"2306.12929","doi":"10.48550/arxiv.2306.12929","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing, November 2023","venue":"arXiv (Cornell University)","work_id":"89445e0c-3933-4673-a0ca-d994606932cf","year":2023},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":146,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:4596615c20462b7b20121cd8c09ac31836d89f760b1cdb410dfca7aeb7f46e34","observation_id":"93d94ed7-f69f-4464-ab16-93cc34900542","resolution":{"observed_at":"2026-06-28T23:32:47.285286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":"2306.12929","doi":"10.48550/arxiv.2306.12929","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing, November 2023","venue":"arXiv (Cornell University)","work_id":"89445e0c-3933-4673-a0ca-d994606932cf","year":2023},"citing_paper":{"arxiv_id":"2606.19005","last_updated":"2026-06-17T12:32:46Z","snapshot_observed_at":"2026-08-04T20:13:29.754744Z","submitted_at":"2026-06-17T12:32:46Z","title":"Sumi: Open Uniform Diffusion Language Model from Scratch","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-26T20:34:43.697141Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2606.19005"},"observation_digest":"sha256:98540b1051c13f0c0c7835819a0c64e3a41e5eb92a8a96751f94bda8df7e7255","observation_id":"59500c8e-b13d-475a-b6aa-defc26e634df","resolution":{"observed_at":"2026-07-04T01:09:19.759555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":"2306.12929","doi":"10.48550/arxiv.2306.12929","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing, November 2023","venue":"arXiv (Cornell University)","work_id":"89445e0c-3933-4673-a0ca-d994606932cf","year":2023},"citing_paper":{"arxiv_id":"2606.20743","last_updated":"2026-06-17T20:30:55Z","snapshot_observed_at":"2026-08-07T05:55:04.918814Z","submitted_at":"2026-06-17T20:30:55Z","title":"Massive Activations Are Architecturally Robust: A Controlled Scratch/Commitment Residual Stream Test","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T20:47:54.133087Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2606.20743"},"observation_digest":"sha256:5d63348f66e31b71e1aa60cb9bc434e440700fbfb5ca3b7f400c169b4af529b9","observation_id":"71ba6eee-d019-44c3-bf16-e5565592380e","resolution":{"observed_at":"2026-07-04T00:59:20.505120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-02T03:22:12.687854Z","title":"Quantizable transform- ers: Removing outliers by helping attention heads do nothing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13925","last_updated":"2026-07-15T15:06:16Z","snapshot_observed_at":"2026-08-06T19:22:23.845116Z","submitted_at":"2026-07-15T15:06:16Z","title":"Thresholded Cross-Attention for Reliable Intensity-Chromaticity Fusion in Low-Light Image Enhancement","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T03:22:12.687854Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2607.13925"},"observation_digest":"sha256:7224300c33e853d2097dd68ba04c67c36adc4f69cc4661d3a487309dcb2d2f17","observation_id":"08f32ffe-9fa9-4d8a-be0c-107e8ed041d5","resolution":{"observed_at":"2026-08-02T03:22:12.687854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-02T12:48:53.848185Z","title":"arXiv:2306.12929 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19358","last_updated":"2026-05-29T03:05:29Z","snapshot_observed_at":"2026-08-06T17:12:57.277538Z","submitted_at":"2026-05-29T03:05:29Z","title":"LISA: Linear-Indexed Sparse Attention for Efficient Long-Context Reasoning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T12:48:53.848185Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2607.19358"},"observation_digest":"sha256:155dd6c4b85c86296f605ec858150fb55123b2be654072db9d4d9bd28d21bea4","observation_id":"73249661-4f80-41e3-b20e-1ae17010694a","resolution":{"observed_at":"2026-08-02T12:48:53.848185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.12929/citation-record","integrity":"/paper/2306.12929/integrity","json":"/paper/2306.12929/citation-record.json","paper":"/paper/2306.12929"},"outbound":[],"paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2306.12929."}